第 2 课 / 抓取到排名状态图
页面上线,不等于能被搜到
看到没排名,先别急着改标题。先用人话分成找不到、打不开、看不懂、不适合展示,再判断页面卡在发现、抓取、渲染、收录、展示,还是点击后的承接。不同状态失败,证据和动作完全不同。
上一课的资产地图先告诉你该盯哪条 URL。 它不证明搜索系统已经找到、抓取或收录了这条 URL。这一课只把那条 URL 的状态查清。
第一次从搜索结果点进这篇时,先任选一个商品、集合或内容页面的页面地址(URL)即可;不需要先读上一课。下面会先把它翻译成“找不到、打不开、看不懂,还是不适合展示”,再决定第一项证据。
状态链路
先说成人话
把搜索引擎想成一个不会买东西的检查员
这个模块可以点击。你先选一个检查动作,再对比“买家看到什么”和“搜索引擎能证明什么”。这样后面看到没收录、没展现、没点击时,就不会一上来改标题或堆关键词。
找不到
症状:页面在店铺后台存在,但站内没有稳定入口,Search Console 也没有可靠发现记录。
先查:先看 sitemap、导航、集合页、相关文章、产品页内链和 URL Inspection 里的发现状态。
这不是标题写得不够好,而是搜索系统可能还不知道这个 URL。
打不开
症状:你在浏览器里能打开页面,但搜索系统可能被 robots、登录、错误状态码、重定向链或慢响应挡住。
先查:在 Search Console 顶部输入完整 URL,打开 URL Inspection,跑 live test,再看 crawl allowed、page fetch、状态码和重定向。
这不是关键词问题,先证明 Google 能稳定抓取当前页面。
看不懂
症状:前台截图看起来完整,但源码或 rendered HTML 里缺少核心商品、正文、分页、筛选链接或 canonical 信号。
先查:对照 page source、URL Inspection 的 rendered page、View crawled page 和最近一次可见的页面内容变化。
这不是继续发文章能解决的问题,先让核心内容稳定可见。
不适合展示
症状:页面被抓取甚至已收录,但 Google 认为它重复、太薄、主版本冲突,或还没有进入有意义的查询场景。
先查:看 Indexing Pages、Google-selected canonical、noindex、重复 URL、Search Console Pages / Queries 和 SERP 竞争页面。
这时才讨论页面价值、搜索意图、内链支持、标题摘要和竞争,不要把所有未收录都当成技术故障。
当前检查
先找到门牌
买家看到什么
买家可能从首页、集合页、博客或广告点进来,看到这张包含 12 个商品的集合页,知道这页存在。
搜索引擎检查员能证明什么
搜索引擎不会逛店,它像一个不会买东西的检查员,只能沿着 sitemap、导航、内链和外部链接发现 URL。
不要这样误判
页面还没入口时就改标题,等于给检查员改了招牌,但门牌仍然找不到。
主资产
抓取到排名状态图:先定位状态,再决定动作
这张状态图先标出URL 现在处在哪一段。按顺序读每张卡:辨认状态,记录该状态需要的第一份证据,再选择动作。抓取不等于收录,收录也不等于会为某个查询展示;不要跳过中间层直接下排名结论。
发现
这一层判断:搜索系统先要知道这个 URL 存在。
证据:sitemap、导航、集合页、文章内链、外部链接、URL Inspection。
页面成了孤岛页,站内没有稳定入口。
抓取
这一层判断:搜索系统请求 URL,读取状态码、HTML、链接和基础信号。
证据:URL Inspection、robots.txt、HTTP 状态码、重定向链、服务器日志。
被 robots、登录、错误状态码(例如 404/500)、超慢响应或重定向链挡住。
渲染
这一层判断:如果核心内容依赖 JavaScript,系统还要像浏览器一样看渲染后页面。
证据:URL Inspection live test、渲染后 HTML、HTML 源码、关键内容是否首屏可见。
商品、正文、内链或标题信号只在复杂 JS 后出现。
收录
这一层判断:系统判断页面是否值得进入索引库。
证据:Pages report、URL Inspection、canonical、noindex、重复内容、页面质量。
页面重复、太薄、意图不清、canonical 指向别处,或被 noindex。
排名 / 展示
这一层判断:已收录后,页面才进入具体查询的竞争。
证据:Search Console 查询词、展现、平均排名、竞争页面、内链支持。
搜索意图不匹配、竞争太强、标题摘要弱,或站内支持不足。
点击 / 承接
这一层判断:有展示以后,还要判断用户是否愿意点击,以及点进来后是否继续行动。
证据:CTR、标题摘要、页面行为、加购、咨询、订单、退款或客服问题。
搜索结果承诺不清,或页面承接、产品、价格、信任路径有问题。
遇到一个刚发布的集合页,可以先写成“发现待确认”,而不是“SEO 失败”。等 URL Inspection、内链入口和 Search Console 状态给出事实,再把它移动到抓取、收录或展示的下一格。这让复盘保留一个可证伪的判断,而不是一串同时发生的改动。
排名判断
收录之后,四个可观察因素决定你该先改哪里
排名不是一个“改标题”按钮。用意图匹配、内容质量、结构清晰度、信任与可用性四个因素,把结果页现象连接到证据和动作;它们帮助你形成下一步判断,但不能保证排名或收录。
意图匹配
要问:这张页面是否完成了这个查询背后的任务,而不是只重复查询词?
可观察证据:把查询词、SERP 结果类型、页面任务和首屏承诺放在一起看。
下一动作:明确页面服务的查询场景,调整页面结构和承诺以匹配该场景。
内容质量
要问:用户是否能从这页得到完整、独特、足以做决定的答案?
可观察证据:检查核心事实、独特说明、产品或案例细节、常见疑问和重复页面信号。
下一动作:补足真正缺失的答案或合并重复页面;不要用堆字数替代信息价值。
结构清晰度
要问:搜索系统和读者能否快速看出页面主题、层次和相关入口?
可观察证据:对照标题层级、清晰锚文本、内链、渲染后的 HTML 和页面点击深度。
下一动作:让一个页面任务有清楚的标题、分段和相关内链,并从 5–10 张重要页面地图开始核对。
信任与可用性
要问:页面是否让人放心阅读和使用,包括可读性与移动端体验?
可观察证据:看作者或来源说明、关键事实、政策与联系方式,再用移动端检查可读性、滚动和主要操作。
下一动作:补足可信依据,修正难读的版式和移动端阻塞;把体验问题写成可复查指标。
互动诊断
URL 当前是什么状态?选错状态,就会改错地方
请主动点击不同症状。这个模块不是让你背流程,而是训练你把没排名拆成可验证状态:先看什么证据、可能卡在哪里、下一步该修哪一层。点完后,把诊断结果写进底部复制笔记总结。
诊断结果
Google 不知道这个 URL
先看:sitemap、内链、导航、是否孤岛页。
可能卡点:没有入口,或者页面没有被提交到稳定 URL 清单。
下一步:补内链和 sitemap,再约定复查日期。不要先改标题。
完整 URL 样例
新品集合页 10 天没自然流量,先证明它卡在哪一层。
“可索引资产”指有独立用户任务、能被发现、理解、收录并服务查询的页面;在 Shopify 里,它常是一张集合页、商品页或文章。页面能在浏览器打开,只说明买家能访问,不说明搜索系统已经看见、理解或愿意展示它。
案例:夏季出行水杯集合页
团队上线集合页 10 天后说“SEO 没效果”。此时还不知道它有没有被发现、抓取、完整渲染、收录,还是已收录但没有进入有意义的查询。直接重写标题或再发一篇相似文章,可能只是把真正的卡点藏起来。
结果解释:十天是一个需要检查的信号,不是失败判决。拿到状态前,不能把“没有流量”归因成关键词、技术或内容质量。
| 阶段 / 症状 | 在哪里看 | 先别做什么 |
|---|---|---|
| 发现:新 URL 没有稳定入口。 | sitemap、导航、相关集合页、文章或商品页内链。 | 不要只提交 sitemap 或先改标题;先补一条可追踪入口。 |
| 抓取 / 渲染:浏览器能开,但 live test、状态码或渲染内容异常。 | URL Inspection、robots.txt、HTTP 状态、重定向、rendered HTML。 | 不要把买家截图当作搜索系统已经看见内容的证明。 |
| 收录:已抓取但未收录,或 canonical / noindex / 重复信号冲突。 | Search Console Pages、URL Inspection、canonical、noindex、重复 URL。 | 不要再发更多相似页面;先决定强化、合并、规范化或不收录。 |
| 展示 / 点击:已收录但无展现,或有展现但低点击。 | Search Console Performance 的 query / impression / CTR、SERP、内链与首屏。 | 不要责怪 sitemap 或反复改技术设置;这时才检查意图、摘要和页面承接。 |
上面的交互选择只是在练习诊断顺序,不会读取你的 Search Console。把页面标签或非敏感路径、状态、证据、下一步、负责人和复查日期写入底部笔记后,才是一条可复查的 SEO 记录。
证据来源
每个工具回答的问题不同,不要把所有问题都叫没排名
URL Inspection
单个 URL 的 indexed version、live test、page fetch、crawl allowed、rendered page 和 canonical 状态。
live test 通过不等于已经收录,也不能证明这个页面一定有排名或流量。
sitemap
你是否把重要 URL 告诉了搜索系统。
不能替代内链,也不保证收录。
内链 / 导航
页面在站内结构里是否有入口、是否被当成重要页面。
不能单独证明页面质量足够。
robots / noindex / canonical
页面是否被抓取、索引或规范化信号挡住。
不能直接解释点击后转化问题。
查询词 / 展现 / CTR
页面进入了哪些搜索场景,用户是否愿意点。
不能单独证明订单质量和利润。
GA4 落地页 / 电商事件
在 Google tag 和相关事件已经正确实施时,读落地页、加购和购买等点击后承接。
不能证明 URL 已收录、进入查询或存在搜索需求;这些仍要回到 Search Console 和 URL Inspection。
新手流程
Crawl to Click Flow:从 URL 被发现到用户点击,要一层一层查
这里把 URL Inspection、sitemap、canonical 和 rendered HTML 放到同一条路径里。Search Console 的 URL Inspection 要输入完整 URL;indexed version 是 Google 之前存下的判断,live test 只检查当前页面是否可能被抓取和进入收录流程。请点击一个环节,查看新手最容易误判什么、应该做什么动作、以及要复制哪条证据。不要把这些工具混成一个“Google 没给流量”的问题。
当前环节
发现入口
新手误判
以为提交 sitemap 就等于 Google 会优先抓取和收录。
应该怎么做
确认 URL 在 sitemap 里,同时从首页、集合页、相关文章或产品页给它稳定内链。sitemap 不能替代内链。
复制到笔记的证据
复制:sitemap submitted / discovered 状态、入口页 URL、anchor text、点击深度、是否孤岛页。
可保存练习
URL 状态诊断器:先把状态读清楚,再决定由谁继续查
这里把抽象的抓取、渲染、收录与展示变成一份页面状态记录。选择只会更新练习,不会读取你的 Search Console、访问真实 URL、提交 sitemap、请求收录或改动页面。真实排查仍要由相应负责人在当前系统里对照同一页面读回。
页面状态记录
先说清页面现在处在哪一层,再决定该看哪份报告
不要填写完整域名、查询参数、账户、凭据、订单、客户或查询导出。请用页面标签或非敏感路径,加上证据摘要、验收指标、负责人、复查日期、下一步、重要页面地图和候选页面。
抓取到展示的状态练习
这是一张练习流程图,不是 Google 的实时爬虫或账户截图。当前场景会突出需要先读的一层。
搜索系统先要知道这个 URL 存在。
搜索系统请求 URL,读取状态码、HTML、链接和基础信号。
如果核心内容依赖 JavaScript,系统还要像浏览器一样看渲染后页面。
系统判断页面是否值得进入索引库。
已收录后,页面才进入具体查询的竞争。
当前页面场景
Crawled - currently not indexed
信号:Google 已抓取页面,但当前没有将它留在索引中。先分开检查重复、canonical、noindex、页面任务和内容价值。
先读:先读 Page indexing report 的原因,再用 URL Inspection 的 indexed version 看 Google-selected canonical 与最近抓取信息。
边界:不要立刻批量重写、复制更多近似页或把 live test 通过写成已收录。
后续研究:由页面负责人比较页面任务、重复 URL 和主版本信号,再决定是强化、合并、规范化或保留为不收录。
Search Console 证据位置图
Search Console > Indexing > Pages
先读状态原因、范围和来源。报告中的示例 URL 有上限,不能把未列出的 URL 当作已验证。
1. 先确定页面级或站点级问题
Page indexing report 用于状态范围和原因;URL Inspection 用于单一完整 URL。
2. 再区分已存版本与当前测试
Google Index 读最近已收录版本;Test live URL 读当前抓取测试。
3. 需要渲染细节时看页面输出
View tested page 或 View crawled page 用来比对截图、HTML、资源与 JavaScript 输出。
当前复查条件
先填写页面标签或非敏感路径;不要填完整域名、查询参数、账号或凭据。
选择下一步,再读错选解释
后台证据路径
把抓取、理解、排名落到可复查字段
状态图不是画完就结束。每个状态都要能回到具体后台路径和字段,否则团队还是会回到“没排名就改标题”。下面这张表可以直接复制到本课笔记:先写后台位置,再写字段、能证明什么、不能下什么结论。
状态 1
未发现 / 入口弱
Search Console -> Sitemaps;URL Inspection;Shopify Online Store -> Navigation;集合页、专题页和产品页内链。
记录字段
- URL、sitemap submitted / discovered 状态、last submitted time。
- 入口页 URL、anchor text、点击深度、页面是否孤岛。
- 是否在首页导航、集合页、相关商品页、相关文章里出现。
能证明:证明搜索系统和站内结构是否真的有机会发现这个页面。
别下这个结论:把入口问题误判成标题问题,或只提交 sitemap 就结束。
下一路线
先补内链和 sitemap 记录;如果入口混乱,再进入 Technical SEO advanced 的 crawl budget / URL governance。
状态 2
抓取或渲染不稳定
URL Inspection -> Live test;server logs;page source / rendered HTML;robots.txt;redirect chain;theme template。
记录字段
- HTTP status、robots allowed / blocked、redirect target、crawl time。
- 核心正文、商品列表、分页、筛选链接、canonical 是否在源码或稳定渲染后可见。
- 当前页面版本、最近一次可见变化、失败 URL 样本。
能证明:证明页面不是只对用户能打开,而是搜索系统也能稳定读取关键内容。
别下这个结论:看到页面能打开就断定抓取没问题;把 JS 渲染失败当成关键词不够。
下一路线
先修 robots、状态码、重定向、模板输出和核心内容可见性;再进入 technical SEO basics。
状态 3
已抓取但未收录
Search Console -> Indexing -> Pages;URL Inspection;canonical / noindex / duplicate checks;内容与集合页任务表。
记录字段
- index status、Google-selected canonical、user-declared canonical、noindex state。
- 重复页面 URL、主版本 URL、页面任务、是否值得独立存在。
- 强化 / 合并 / canonical / noindex / 删除决定和复查日期。
能证明:证明问题是在页面价值、重复、规范化信号,还是搜索系统选择了另一个主版本。
别下这个结论:把所有未收录页面都当成技术故障。
下一路线
先决定页面去留和主版本;复杂参数、分页、重复问题进入 Technical SEO advanced。
状态 4
已收录但展示 / 点击弱
Search Console -> Performance -> Search results;Pages / Queries / Countries / Devices;SERP 手动复查;GA4 landing page。
记录字段
- URL、query、impressions、clicks、CTR、average position、country、device。
- SERP 页面类型、标题链接、摘要承诺、竞争页面、当前 ranking URL。
- landing page engagement、add_to_cart、purchase、support question。
能证明:证明页面是否进入了正确查询场景、用户是否愿意点击,以及点击后页面能不能承接。
别下这个结论:把低展现、低 CTR 和低转化混成一个“排名差”。
下一路线
低展现进入关键词课;低 CTR 进入页面标题和摘要;低转化进入 CRO / PDP / 定价路径。
站点阶段
新站和老站的问题不一样,别拿同一套动作套所有页面
“新站 / 老站”只是决定从哪份证据开始,不是给 URL 找借口。新站先证明核心页有稳定入口和可抓取版本;老站先找同类 URL、历史版本或内链结构里是否出现冲突。无论站龄如何,当前 URL 的状态和证据都比“网站年纪”更能决定下一步。
新站
先关注:稳定发现、清晰结构、基础页面质量、Search Console 建档。
常见错法:用成熟站的排名速度要求自己。
第一检查:核心页面是否在导航、集合页、sitemap 和内链里都有入口。
老站
先关注:重复内容、旧结构、低价值页面、canonical、内部竞争。
常见错法:只靠新增页面解决所有流量问题。
第一检查:哪些页面应该强化、合并、重定向、noindex 或删除。
排查样例
同一句没排名,可能是 4 个完全不同的问题
每一行只提供一个诊断起点。先做这一行的第一检查;证据排除它后再进入下一层。这样“没排名”不会把内容、技术、内链和标题同时变成猜测性的待办。
新产品页上线 2 天没有流量
先看 URL 是否被发现、是否在 sitemap 和集合页内链里。2 天内没流量不等于页面失败。
页面显示 Crawled - currently not indexed
先判断页面是否重复、太薄、canonical 冲突,别急着发更多相似文章。
已收录但没有展现
回到关键词和页面任务:这个页面到底要进入哪个搜索场景?站内有没有支持它的内链?
有展现但 CTR 很低
这时才看标题链接、摘要、首屏承诺和竞争结果形态,不要把问题推给 sitemap。
快速自测
页面没排名,第一反应应该是什么?
这个自测专门拦截一个坏习惯:一看到没排名就改标题。请选择你最想做的动作,查看反馈,再决定是否进入关键词课。
选择一个动作。这个自测用来避免没排名就改标题的惯性。
暂停 / 继续
搜索状态排查的放行规则
这一关先为一个核心 URL 留下状态、证据、负责人和复查日期。有了这四项,下一课的关键词和页面工作就不会反过来掩盖技术或收录问题。
先暂停
页面没收录就先改标题。只提交 sitemap,不补内链。页面被抓取就以为一定会收录。已收录无展现就只怪技术。不写复查日期和负责人。
可以继续
- 先定位状态。
- 每个核心 URL 有证据来源。
- 动作对应失败环节。
- 复查日期和负责人写清。
- 点击后问题交给页面、产品、定价或信任路径复盘。
复制笔记总结
把这篇教程变成一份 URL 状态排查复制笔记总结
下面这段会随着你选择的 URL 症状和自测结果变化。它保留当前状态与第一证据,复制后带到关键词课,后面关键词、页面和内容动作才不会修错层。
搜索状态判断:页面上线不等于可搜索。先判断是找不到、打不开、看不懂,还是不适合展示,再定位发现、抓取、渲染、收录、展示或点击承接。 搜索引擎检查员当前检查:先找到门牌;第一证据:先看 URL 是否在 sitemap、导航、集合页、相关文章或产品页内链里。 当前 URL 症状:Google 不知道这个 URL。 第一证据:sitemap、内链、导航、是否孤岛页。 可能卡点:没有入口,或者页面没有被提交到稳定 URL 清单。 下一步动作:补内链和 sitemap,再约定复查日期。不要先改标题。 Crawl to Click Flow 当前步骤:发现入口;工具:Sitemaps + 站内入口;证据:复制:sitemap submitted / discovered 状态、入口页 URL、anchor text、点击深度、是否孤岛页。 URL 状态实验室:Crawled - currently not indexed;证据面:Search Console > Indexing > Pages;后续研究:由页面负责人比较页面任务、重复 URL 和主版本信号,再决定是强化、合并、规范化或保留为不收录。 快速自测:还没有选择。先完成自测,再决定是否进入关键词课。 页面标签/非敏感路径:未填写 证据摘要:未填写 验收指标:未填写 Request indexing 请求日期(完成修复后再填):尚未请求 负责人:未填写;复查日期:未填写;下一步动作:未填写 重要页面地图(5–10 行): 未填写 候选页面(至少 3 行,孤岛/重复/低价值): 未填写 记录放行状态:字段仍不完整,先补齐上面的记录 后台证据字段:URL Inspection、Sitemaps、Indexing Pages report、Live test、server logs、page source / rendered HTML、robots.txt、canonical / noindex、Search Console Pages / Queries、GA4 landing page。