url inspection 逐行怎么读:默认那份不是实时的
url inspection 默认给你看的不是实时页面,而是 Google 上次收录时的记录。十来行里真正决定结果的只有三行 —— 这是逐行读法、四种判定各自的下一步,以及 canonical 不一致时的五步排查顺序。

「我自己明明能打开,Search Console 里怎么说没收录」—— 这个问题九成出在同一个地方:url inspection 默认给你看的不是实时页面,是 Google 上次收录时的那一份记录。整份报告十来行,真正决定结果的只有三行:Crawl allowed?、Indexing allowed? 和 Google-selected canonical。读懂这三行,加上知道什么时候该点实时测试,这个工具就用对了。
读这篇前
需要一个已验证的 Search Console 资源,还需要知道 canonical 标签是一个声明而不是一条指令 —— 这件事写在 canonical 标签该留哪个网址。这一节只讲怎么读这份报告;怎么先把页面推进队列,写在 页面改完之后怎么推送收录。
两份报告,差别就在这儿
检查一个网址,默认拿到的是已收录版本。Google 的帮助写得毫不含糊:「This is not a live test. The results shown are from most recently indexed version of a page, not the live version on the web.」实时测试是另一个按钮,它「fetches and examines the URL in real time. The information shown in the live test can differ from the indexed URL」(URL Inspection tool,2026-09-02 访问)。
两份报告回答的问题不一样。默认那份答的是「Google 知道什么」,实时测试答的是「Google 现在能不能取到」。改完页面,后者立刻就变,前者要等下一次抓取才变 —— 这正是绝大多数人以为工具坏了的原因。
什么时候看哪一份,其实有个很省事的判据:想知道「现在线上这一页对不对」,看实时测试;想知道「搜索结果里为什么是这个样子」,看默认那份。改完东西马上去看默认报告,只会看到改之前的世界。
默认报告是 Google 的记忆,实时测试是 Google 的视力。真正的诊断动作,是把两份摆在一起比。
url inspection 逐行怎么读
最上面是一个判定,四选一,每一种对应的下一步都不同。
| 判定 | 下一步做什么 |
|---|---|
| URL is on Google | 这里没事,去看 Performance 报告 |
| on Google, but has issues | 看增强项那一段,页面本身已收录 |
| URL is not on Google | 按下面三行决定项往下走 |
| URL is an alternate version | Google 选了别的 canonical,直接跳到那两行 |
判定下面是分组的:发现那组说 Google 怎么找到这一页,抓取那组说取的时候发生了什么,编入索引那组说它最后认定哪个网址。
| 行 | 答什么 | 取值不对 |
|---|---|---|
| Sitemaps | 哪份网站地图列了它 | 空:发现只能靠链接 |
| Referring page | Google 从哪儿找到的链接 | 空:可能是孤岛页 |
| Last crawl | 这份报告背后那次抓取的日期 | 日期很旧:下面全是旧的 |
| Crawled as | 手机还是桌面爬虫 | 和你自己测的那一端对不上 |
| Crawl allowed? | robots.txt 放不放行 | No:改 robots.txt,别往下读 |
| Page fetch | 服务器有没有把页面给出来 | 失败:服务器、跳转或超时 |
| Indexing allowed? | 页面上有没有 noindex | No:先找到那条 noindex |
| User-declared canonical | 你的页面声明的网址 | 不是你想的那个:模板在猜 |
| Google-selected canonical | Google 最后选的网址 | 和你声明的不同:你的声明输了 |
动手做:四步
按这个顺序读。每一步有完成标志,任何一步失败,后面几步都不用看。
- 读判定,原样抄下来。完成标志:能说清自己在四种里的哪一种,不用转述。
- 依次看
Crawl allowed?、Page fetch、Indexing allowed?。完成标志:碰到第一个 No 就是要修的东西,到此为止。 - 把两行 canonical 放一起比。完成标志:两个一致,或者你把 Google 选的那个记了下来。
- 跑一次实时测试,和默认那份对照。完成标志:知道这个问题是当下的还是历史的。
第 3 步值得单独说一句:两行 canonical 不一致时,真正变了的是 Google 拿哪个网址去参与排名。你在 Performance 报告里找不到自己那个地址的数据,往往就是因为流量全记在它选中的那一个上。先把这一对抄下来,再去下一节排查。
第 2 步是一个顺序,不是一张清单。被 robots.txt 挡住的页面,下面几行也会显示成没用的值,先去追那几行就是下午消失的方式。
交付物:canonical 不一致时的排查顺序
Google-selected canonical 和 User-declared canonical 不一样时,按下面五条依次查,中了第一条就停。
- 这一页到底有没有发出 canonical 标签?取一次源码看,模板漏掉它的频率比谁想的都高。
- 标签指向的网址返回 200 吗?协议和主机名是不是你要的那一个?
- Google 选中的那一页内容是不是几乎相同?如果是,它做的是一次重复内容判定,要修的是差异化而不是标记。
- 它选的那个网址,是不是你站内链接都指向的那一个?Google 会看你的链接,一个和全站链接相反的 canonical 是很弱的信号。
- 它选的那个在网站地图里,而你声明的那个不在?
第 3 条是最常中的一条,也是最容易被误修的一条:两个网址内容几乎一样时,加再多的 canonical 标签也改不了判定,因为 Google 已经认定它们是同一份内容。这种情况要么把其中一个写成真的不一样,要么接受它,别在标记上来回折腾。
这五条都不需要 curl 和这份报告之外的任何工具。五条走完什么也没找到,就把这一对记下来往前走 —— 一个已经被收录的页面上的 canonical 分歧,不是急事。
三种常见的做错
三种都很常见,第三种还会白白烧掉配额。
第一种是把一份过期报告当成今天的状态。Last crawl 印在抓取那一组的最上面就是为了这件事:如果它写的是六周前,下面每一行描述的都可能是一个已经不存在的版本。
第二种是把实时测试通过当成收录确认。Google 直接回答过:「Does a valid result mean that my page will be indexed? No. The live URL test only confirms if Google-InspectionTool can access your page for indexing.」同一页还补了一句 —— 「even if you get a valid or warning verdict in the live test, your page must still fulfill other conditions in order to be indexed」。
第三种是对着同一个网址反复点「请求编入索引」。Google 写明「there's a quota for submitting individual URLs and requesting a recrawl multiple times for the same URL won't get it crawled any faster」,并把现实的等待区间给成「anywhere from a few days to a few weeks」(Ask Google to recrawl your URLs,2026-09-02 访问)。
这条路到哪儿为止
这个工具一次只看一个网址,所以它是诊断仪器,不是审计工具。十二个页面没问题,一千二百个就该走 page indexing 报告和网站地图了 —— 到那个量还在逐个查网址,是在用手做一个文件能做的事。
做多语言站的还有一个额外的坑:拿首页查完就以为全站都对。多语言目录、分页列表、带参数的筛选页,在这份报告里各有各的状态,尤其 canonical 那两行几乎必然不同。要下判断,就按模板各取一个代表网址分别查。
它也回答不了另一件事:页面明明取到了,Google 为什么没收。抓取放行、页面取到、允许编入索引,结果仍然不在 Google 上 —— 报告里没有这一行,我们也没有。剩下的只有页面本身和它上线多久了,那件事写在 google 收录一般要多久。在为它花掉一周之前,先确认引擎能不能读到这一页的内容,可以跑一次 QueryWin 的差距检查。
常见问题
url inspection 到底显示的是什么?
默认是 Google 最近一次收录的那个版本:怎么发现的、上次什么时候抓的、抓取和编入索引允不允许、以及它认定哪个网址是 canonical。实时测试是另一个动作,会当场去取一次页面。
为什么它说我的页面不在 Google 上,我却能打开?
你能在浏览器里打开,说明你的服务器在正常发页面。这份报告说的是 Google 自己的记录,两者不在一个时钟上。先看 Last crawl,再跑实时测试对照。
「URL is an alternate version」是什么意思?
Google 认定另一个网址才是这份内容的 canonical,这个地址被当成了变体。直接看那两行 canonical,按上面五条顺序排查。
请求编入索引会更快吗?
点一次,也许。反复点,不会 —— Google 写明同一网址重复请求不会加快,而一次抓取可能要几天到几周。
实时测试是哪个爬虫在跑?
是 Google-InspectionTool,和 Googlebot 是两个代理。如果你的防火墙规则是按 UA 名写的,从一次失败的抓取里下结论之前,值得先确认这一点。
本文属于 QueryWin 实操手册 · 第 2 阶


