page indexing report 怎么读:一次读一条原因

page indexing report 是唯一能一次性告诉你 Google 把哪些页面漏在外面、各是什么原因的地方。当两个问题读:你在乎的页面在已编入索引那一桶吗,未编入索引那桶里每条原因是不是你自己选的。含十行分诊表,每行都是 Google 自己的定义。

效果衡量8 分钟读完1864 次阅读
page indexing report 怎么读:一次读一条原因

page indexing report 是唯一一个能一次性告诉你「Google 把哪些页面漏在外面、各是什么原因」的地方。把它当两个问题读,不是一个:你在乎的那些页面在「已编入索引」那一桶里吗,以及「未编入索引」那一桶里的每一条原因,是不是你自己选的。那一桶里大部分东西本来就该在那儿。下面那张分诊表说清楚哪几行才轮到你动手。

读这篇前你要有什么

一个验证过的 Search Console 资源,以及一个页面数量已经多到没法一个个查的站。只想知道某一个网址是什么状态的,那是另一个工具、也有更快的答案,逐行读法在 url inspection 怎么逐行读。这一章是站级视角,回答的是单网址工具答不了的那个问题:你哪一类毛病发生了 400 次。

「未编入索引」不是一张错误清单

报表自己的定位很克制:「See which pages Google can find and index on your site, and learn about any indexing problems encountered」(Page indexing report,Google Search Console 帮助,2026-09-07 访问)。它把 Google 已知的网址分成两桶。已编入索引的意思是「these URLs were successfully indexed」。未编入索引的意思是「the URL is not indexed, either because of an indexing error, or because of a legitimate reason」。

最后那半句就是这一整章。两类东西被装在同一个桶、同一个计数里,所以这个数字涨了本身不是坏消息。Google 说得很直接:「Don't expect every URL on your site to be indexed. Some URLs might be duplicates or might not contain meaningful information. Just be sure that the key pages on your site are indexed.」还有更具体的一句:「Non-indexed URLs can be fine. Read and understand the specific reason for each non-indexed URL to confirm that the page shouldn't be indexed.」

未编入索引那个数字不是分数。它下面那些原因才是报表本身。

一个有分页、有筛选、有跳转、有 canonical 策略的站,会正当地攒下成千上万个被排除的网址,曲线往上走正是一个在长大的站该有的样子。真正的失败方式跟恐慌相反——是因为总数看着稳,就从来没点开过那些原因。

出海站最常见的误读:把这个数字当降权信号

中文出海圈里这件事几乎每周都在发生:看到「未编入索引 3,200」,第一反应是站被 Google 惩罚了,接着开始到处提交网址。点开原因往往会发现,最大的那一行是「Page with redirect」或者「Alternate page with proper canonical tag」——两行都是你自己做对了事情之后的必然结果。

先看已编入索引那个数够不够,再看未编入索引里的构成。顺序反了,就会去修一堆本来就不该修的东西。

动手做:按这个顺序读 page indexing report

五步。顺序反了,人就会去修一行本来不是问题的东西。

  1. 先看已编入索引那个数,不是先看未编入索引那个。问自己:它跟你打算让多少个页面被收录大致对得上吗。完成标志:一个写下来的预期数字,以及它和报表的差。
  2. 打开未编入索引的列表,按页面数排序。原因是按各自网址数量排的,前两三条通常就占了这一桶的大部分。完成标志:前三条原因和它们的数量,写下来。
  3. 动手之前,先拿下面那张表把这几条原因各归一次类。完成标志:你的每一条主要原因都被标成「本来就该这样」或者「该我修」。
  4. 凡是标成该你修的,打开它的示例网址,挑两三个单独查一遍。报表告诉你类别,单网址工具告诉你某一个具体地址到底怎么了。完成标志:你能在一个真实网址上说出成因,而不只是说出类别。
  5. 先修成因,再对那一行点验证修正。完成标志:那一行显示验证进行中,而且你把开始的日期记下来了。

第五步带着一个官方写明的等待期,动手前先把预期摆正:「Validation typically takes up to about two weeks, but in some cases can take much longer.」

交付物:十行原因分诊表

每一行都是 Google 自己对该状态的定义,右边那一列先读——十行里有五行在一个健康的站上属于正常现象。

原因Google 的定义该你修吗
Not found (404)"This page returned a 404 error when requested."只有还有东西链着它才修
Blocked by robots.txt"This page was blocked by your site's robots.txt file."只有你本来没想挡它才修
URL marked 'noindex'Google "encountered a 'noindex' directive and therefore did not index it"只有标签打错了页才修
Page with redirect"This is a non-canonical URL that redirects to another page. As such, this URL will not be indexed."不用,正常
Alternate page with proper canonical tag"This page correctly points to the canonical page, which is indexed, so there is nothing you need to do."不用,正常
Duplicate without user-selected canonical"This page is a duplicate of another page, although it doesn't indicate a preferred canonical page."要,去声明 canonical
Duplicate, Google chose different canonical"Google thinks another URL makes a better canonical",并且收录了它选的那个看情况,先看赢的是哪个
Soft 404返回 "a user-friendly 'not found' message but not a 404 HTTP response code"要,去返回真正的 404
Crawled - currently not indexed"The page was crawled by Google but not indexed. It may or may not be indexed in the future; no need to resubmit this URL for crawling."没有直接的开关,见下
Discovered - currently not indexed"Google wanted to crawl the URL but this was expected to overload the site; therefore Google rescheduled the crawl."要,去看服务器承载

有两行要格外小心,因为它们正是最多人拿错工具去修的。Crawled - currently not indexed 身上没有挂任何开关:Google 在同一句里就说了「no need to resubmit this URL for crawling」。重新提交是最常见的反应,而它被官方明确否掉了。Discovered - currently not indexed 不一样——Google 点了成因,而且那个成因在你的服务器上,所以有用的动作是去看响应时间,不是去看那个页面。

另一个坑在报表自己身上,不在你的站上:「The list of example URLs in the report is limited to 1,000 items, and isn't guaranteed to show all URLs in a given status.」计数才是数据,网址列表只是样本。别把示例列表当清单导出,也别因为你认得的那几个地址不再出现就判定这一行修好了。

三种做错的方式

第一种是把未编入索引的总数当健康指标盯着,而不盯原因。你加了分页它会涨,你把 canonical 设对了它会涨,你把老网址跳转走了它还会涨——这三件都是你故意做的。该盯的是已编入索引那个数对不对得上预期,以及原因的构成变没变。

第二种是哪一行最大就修哪一行。多数站上最大的那行是 Page with redirect 或者 Alternate page with proper canonical tag,而后者的官方原话结尾就是「there is nothing you need to do」。行数大小排的是数量,不是「它是不是问题」。

第三种是没修就先点验证。验证修正是请 Google 重新检查那一行里的网址,成因还在的时候点它,等于花掉最多两周走到同一个结论。先在两三个示例网址上单独确认修好了,再验证整行。

这一章到哪儿为止

四条边界,前两条是关于这份报表压根不会告诉你的东西。

  1. 它只覆盖 Google 已经发现的网址。没人链、sitemap 也没收的页面不会在这里显示成问题,因为它根本不在报表里。找那些页面是另一件事、另一个入口。
  2. 收录不等于有排名,这份报表也完全不说流量。一个页面可以在已编入索引那一桶里躺几个月而一次曝光都没有,回答那个问题的是另一份报表。
  3. 示例网址每个状态上限 1000 条且不保证完整,所以这份报表用来找类别和量级,不能当任务清单导出。
  4. 关于「修完多久能看到变化」,我们不打算给出超过 Google 原话的说法——「up to about two weeks, but in some cases can take much longer」。我们没有在对照样本上测过,给你更确切数字的人也没有。

表里有两行直接指向能修它们的章节。noindex 那行和 robots.txt 那行都是「有意排除」,这两种机制怎么选在 什么时候该给页面加 noindex。Discovered 和 Crawled 两行都是在等,现实的时间窗长什么样在 google 收录要多久。如果报表显示页面一直进得来却留不下,值得先查的是爬虫最初拿到的是什么,看看 QueryWin 从一个页面里读出什么

常见问题

Crawled - currently not indexed 是什么意思

Google 抓了这个页面,然后决定暂时不收。官方说法是它「may or may not be indexed in the future」,并且补了一句「no need to resubmit this URL for crawling」。没有任何开关能把页面从这一行挪走,这也是它最让人上火的地方。它是对页面本身的判断,所以要动的是页面。

未编入索引的数字很大是不是有问题

单看这个数字不是。Google 的说法就是让你别期待全收:「Don't expect every URL on your site to be indexed. Some URLs might be duplicates or might not contain meaningful information.」跳转、canonical 设对了的副本、你自己排除掉的页面,都会落在那儿。读构成,别读总数。

验证修正要等多久

Google 的说法是「typically takes up to about two weeks, but in some cases can take much longer」。确认过示例网址真的修好了再点它,因为成因还在的时候跑一轮验证,会把整个窗口花在得到同一个结果上。

为什么报表里的网址比我站上的少

两个不同的原因,很容易混。一是这份报表只覆盖 Google 已发现的网址,没人链、sitemap 也没有的页面是缺席,不是被标记。二是示例列表每个状态上限 1000 条且不保证完整,所以列表短不代表这一行小——该读的是它上面那个计数。

该用这份报表还是 url inspection

两个都用,按这个顺序。这份报表告诉你有哪几类问题、各有多大;单网址工具告诉你某一个具体地址发生了什么。站大了还直接一个个查,等于在不知道哪个模式值得查的情况下挨个查地址。

本文属于 QueryWin 实操手册 · 第 2 阶

page indexing report 怎么读:一次读一条原因