url inspection 逐行怎么读:默认那份不是实时的

url inspection 默认给你看的不是实时页面,而是 Google 上次收录时的记录。十来行里真正决定结果的只有三行 —— 这是逐行读法、四种判定各自的下一步,以及 canonical 不一致时的五步排查顺序。

效果衡量6 分钟读完2797 次阅读
url inspection 逐行怎么读:默认那份不是实时的

「我自己明明能打开,Search Console 里怎么说没收录」—— 这个问题九成出在同一个地方:url inspection 默认给你看的不是实时页面,是 Google 上次收录时的那一份记录。整份报告十来行,真正决定结果的只有三行:Crawl allowed?Indexing allowed?Google-selected canonical。读懂这三行,加上知道什么时候该点实时测试,这个工具就用对了。

读这篇前

需要一个已验证的 Search Console 资源,还需要知道 canonical 标签是一个声明而不是一条指令 —— 这件事写在 canonical 标签该留哪个网址。这一节只讲怎么读这份报告;怎么先把页面推进队列,写在 页面改完之后怎么推送收录

两份报告,差别就在这儿

检查一个网址,默认拿到的是已收录版本。Google 的帮助写得毫不含糊:「This is not a live test. The results shown are from most recently indexed version of a page, not the live version on the web.」实时测试是另一个按钮,它「fetches and examines the URL in real time. The information shown in the live test can differ from the indexed URL」(URL Inspection tool,2026-09-02 访问)。

两份报告回答的问题不一样。默认那份答的是「Google 知道什么」,实时测试答的是「Google 现在能不能取到」。改完页面,后者立刻就变,前者要等下一次抓取才变 —— 这正是绝大多数人以为工具坏了的原因。

什么时候看哪一份,其实有个很省事的判据:想知道「现在线上这一页对不对」,看实时测试;想知道「搜索结果里为什么是这个样子」,看默认那份。改完东西马上去看默认报告,只会看到改之前的世界。

默认报告是 Google 的记忆,实时测试是 Google 的视力。真正的诊断动作,是把两份摆在一起比。

url inspection 逐行怎么读

最上面是一个判定,四选一,每一种对应的下一步都不同。

判定下一步做什么
URL is on Google这里没事,去看 Performance 报告
on Google, but has issues看增强项那一段,页面本身已收录
URL is not on Google按下面三行决定项往下走
URL is an alternate versionGoogle 选了别的 canonical,直接跳到那两行

判定下面是分组的:发现那组说 Google 怎么找到这一页,抓取那组说取的时候发生了什么,编入索引那组说它最后认定哪个网址。

答什么取值不对
Sitemaps哪份网站地图列了它空:发现只能靠链接
Referring pageGoogle 从哪儿找到的链接空:可能是孤岛页
Last crawl这份报告背后那次抓取的日期日期很旧:下面全是旧的
Crawled as手机还是桌面爬虫和你自己测的那一端对不上
Crawl allowed?robots.txt 放不放行No:改 robots.txt,别往下读
Page fetch服务器有没有把页面给出来失败:服务器、跳转或超时
Indexing allowed?页面上有没有 noindexNo:先找到那条 noindex
User-declared canonical你的页面声明的网址不是你想的那个:模板在猜
Google-selected canonicalGoogle 最后选的网址和你声明的不同:你的声明输了

动手做:四步

按这个顺序读。每一步有完成标志,任何一步失败,后面几步都不用看。

  1. 读判定,原样抄下来。完成标志:能说清自己在四种里的哪一种,不用转述。
  2. 依次看 Crawl allowed?Page fetchIndexing allowed?。完成标志:碰到第一个 No 就是要修的东西,到此为止。
  3. 把两行 canonical 放一起比。完成标志:两个一致,或者你把 Google 选的那个记了下来。
  4. 跑一次实时测试,和默认那份对照。完成标志:知道这个问题是当下的还是历史的。

第 3 步值得单独说一句:两行 canonical 不一致时,真正变了的是 Google 拿哪个网址去参与排名。你在 Performance 报告里找不到自己那个地址的数据,往往就是因为流量全记在它选中的那一个上。先把这一对抄下来,再去下一节排查。

第 2 步是一个顺序,不是一张清单。被 robots.txt 挡住的页面,下面几行也会显示成没用的值,先去追那几行就是下午消失的方式。

交付物:canonical 不一致时的排查顺序

Google-selected canonicalUser-declared canonical 不一样时,按下面五条依次查,中了第一条就停。

  1. 这一页到底有没有发出 canonical 标签?取一次源码看,模板漏掉它的频率比谁想的都高。
  2. 标签指向的网址返回 200 吗?协议和主机名是不是你要的那一个?
  3. Google 选中的那一页内容是不是几乎相同?如果是,它做的是一次重复内容判定,要修的是差异化而不是标记。
  4. 它选的那个网址,是不是你站内链接都指向的那一个?Google 会看你的链接,一个和全站链接相反的 canonical 是很弱的信号。
  5. 它选的那个在网站地图里,而你声明的那个不在?

第 3 条是最常中的一条,也是最容易被误修的一条:两个网址内容几乎一样时,加再多的 canonical 标签也改不了判定,因为 Google 已经认定它们是同一份内容。这种情况要么把其中一个写成真的不一样,要么接受它,别在标记上来回折腾。

这五条都不需要 curl 和这份报告之外的任何工具。五条走完什么也没找到,就把这一对记下来往前走 —— 一个已经被收录的页面上的 canonical 分歧,不是急事。

三种常见的做错

三种都很常见,第三种还会白白烧掉配额。

第一种是把一份过期报告当成今天的状态。Last crawl 印在抓取那一组的最上面就是为了这件事:如果它写的是六周前,下面每一行描述的都可能是一个已经不存在的版本。

第二种是把实时测试通过当成收录确认。Google 直接回答过:「Does a valid result mean that my page will be indexed? No. The live URL test only confirms if Google-InspectionTool can access your page for indexing.」同一页还补了一句 —— 「even if you get a valid or warning verdict in the live test, your page must still fulfill other conditions in order to be indexed」。

第三种是对着同一个网址反复点「请求编入索引」。Google 写明「there's a quota for submitting individual URLs and requesting a recrawl multiple times for the same URL won't get it crawled any faster」,并把现实的等待区间给成「anywhere from a few days to a few weeks」(Ask Google to recrawl your URLs,2026-09-02 访问)。

这条路到哪儿为止

这个工具一次只看一个网址,所以它是诊断仪器,不是审计工具。十二个页面没问题,一千二百个就该走 page indexing 报告和网站地图了 —— 到那个量还在逐个查网址,是在用手做一个文件能做的事。

做多语言站的还有一个额外的坑:拿首页查完就以为全站都对。多语言目录、分页列表、带参数的筛选页,在这份报告里各有各的状态,尤其 canonical 那两行几乎必然不同。要下判断,就按模板各取一个代表网址分别查。

它也回答不了另一件事:页面明明取到了,Google 为什么没收。抓取放行、页面取到、允许编入索引,结果仍然不在 Google 上 —— 报告里没有这一行,我们也没有。剩下的只有页面本身和它上线多久了,那件事写在 google 收录一般要多久。在为它花掉一周之前,先确认引擎能不能读到这一页的内容,可以跑一次 QueryWin 的差距检查

常见问题

url inspection 到底显示的是什么?

默认是 Google 最近一次收录的那个版本:怎么发现的、上次什么时候抓的、抓取和编入索引允不允许、以及它认定哪个网址是 canonical。实时测试是另一个动作,会当场去取一次页面。

为什么它说我的页面不在 Google 上,我却能打开?

你能在浏览器里打开,说明你的服务器在正常发页面。这份报告说的是 Google 自己的记录,两者不在一个时钟上。先看 Last crawl,再跑实时测试对照。

「URL is an alternate version」是什么意思?

Google 认定另一个网址才是这份内容的 canonical,这个地址被当成了变体。直接看那两行 canonical,按上面五条顺序排查。

请求编入索引会更快吗?

点一次,也许。反复点,不会 —— Google 写明同一网址重复请求不会加快,而一次抓取可能要几天到几周。

实时测试是哪个爬虫在跑?

是 Google-InspectionTool,和 Googlebot 是两个代理。如果你的防火墙规则是按 UA 名写的,从一次失败的抓取里下结论之前,值得先确认这一点。

本文属于 QueryWin 实操手册 · 第 2 阶

url inspection 逐行怎么读:默认那份不是实时的