3 级 · 按顺序读
QueryWin 实操手册
如何在 Google 上拿到排名、在 AI 回答里被推荐,按该学的顺序写下来。
- 第 1 阶
打基础
尚未接触过 SEO 或 GEO,从这里开始。
- 1怎么查网站能不能被 AI 抓取(一条命令跑完)要查网站能不能被 AI 抓取,最快的办法是拿各家 AI 爬虫的身份去请求一次,看返回码。这篇给可直接粘的命令、值得测的 12 个爬虫,以及两个根本测不了的。
- 2robots.txt 怎么写才管得住 AI 爬虫robots.txt 怎么写才管得住 AI 爬虫?难点不在语法,在一条规则:爬虫找到自己的名字后就不再看 User-agent: * 那一段。附 16 个 UA 的三档判断表和一段可直接粘的配置。
- 3是 Cloudflare 屏蔽 AI 爬虫,还是别的东西在挡浏览器打得开、AI 爬虫却 403,多半是 Cloudflare 屏蔽 AI 爬虫这类边缘拦截。一个响应头就能认出是哪一家,附 11 个站的实测结果和各平台的开关名。
- 4Search Console 关键词怎么看:先只看差一点的那一批Search Console 关键词怎么看?先只看排在 5 到 15 名的那批——已经上榜、没上第一屏。附完整筛选条件和先做哪一条的排序表。
- 5内容怎么写才会被 AI 引用:一段话能不能被单独拎走内容怎么写才会被 AI 引用?判据是一段话被摘出去还成不成立。附七条按影响排序的改法,和同一个意思的两种写法对照。
- 6改之前先存基线,不然十四天后没法比改之前先存基线,否则后面的复盘没有对照。五样要存的东西、一条能重复跑的命令、以及哪两样事后补不回来。
- 7一页纸改写工单:八处改动,三处不许碰一页纸改写工单:四十分钟、八处按顺序的改动、三处绝对不能动的地方。含 Google 对「改日期让内容显新鲜」的原话。
- 8页面改完之后怎么推送收录:三步加一次复验页面改完之后怎么推送收录:sitemap、Search Console 请求编入索引、IndexNow,按顺序做完再等 48 小时复验。附回执状态码判读表。
- 9怎么判断这次改动有没有用:十四天复盘怎么判断这次改动有没有用?十四天后拿同样四个数跟基线对照,三种结果各走各的下一步——以及这个复盘答不了什么。
- 第 2 阶
实操
可立即按步骤执行的操作流程。
- 1谷歌爬虫之外,robots.txt 里还有八个名字要处理谷歌爬虫你已经认识了,现在 robots.txt 里还有八个名字,其中三个根本不发请求。这里是每个名字挡掉的代价、六条完整 UA 串,和一段可以直接粘的配置。
- 2googlebot ip 怎么验:日志里那串 UA 是可以照抄的找 googlebot ip 名单的人多半想拿去配防火墙。名单有,但两次 DNS 查询比名单准。这一章给两步反查正查的完整命令、三种没有 host 命令时的替代写法,以及九份官方 IP 清单和一个能直接跑的比对脚本。
- 3log file analysis 怎么做:从服务器日志看 AI 爬虫到底来没来log file analysis 读的是服务器早就替你记下的两列:User-Agent 和 IP。这一章给一条能直接粘的命令、一张字段表、一张令牌表,以及怎么判断哪些行可以相信。
- 4网站防火墙挡住的,往往正是你想放进来的 AI 爬虫网站防火墙这一层在托管平台上通常不归你改,而它正是 AI 爬虫被拒绝的地方。四家平台各让你动哪一层、按什么顺序诊断、以及两种改了等于没改的情况。
- 5AI 爬虫会执行 JavaScript 吗:先查它实际收到了什么AI 爬虫会执行 JavaScript 吗?多数不会,所以页面能返回 200 却什么都没说。一条命令看爬虫实际拿到的内容,加三种修法和各自代价。
- 6content-security-policy 会不会挡住 Google 渲染器:怎么判断、怎么查、什么时候停手content-security-policy 是你自己加的,但执行它的是 Google 渲染器里那个 headless Chromium。站是前端渲染的、页面在自己浏览器里看着正常,不等于渲染器拿得到正文。三步把这个成因排除掉,附一条能粘的命令和一张指令判读表。
- 7mobile first indexing 怎么查:手机拿到的那一份,才是 Google 留下的那一份mobile first indexing 的意思是 Google 拿手机版内容去收录和排名。这一章给一套两次抓取的对照流程:同一个地址分别以 Googlebot Smartphone 和 Googlebot Desktop 抓一遍,再比正文长度、结构化数据、robots meta 与图片 alt 四项,附 Google 官方那份七行一致性清单。
- 8http-equiv 这一族 meta 标签:七个取值里,哪些还有用、哪些该换掉http-equiv 是让 meta 元素冒充 HTTP 响应头的属性,而大家还往里塞的大多数取值什么都不做。HTML 标准定义了七个:四个还有作用,两个是 Google 真正会读的。这一章是一张路由表。
- 9mixed content 怎么修:浏览器升级了哪些、挡了哪些,还有一条能跑的排查命令mixed content 是 HTTPS 页面发出的 http:// 请求。浏览器会自己把图片、视频、音频升级成 HTTPS,其余的一律挡掉,所以一条 http:// 地址就能让一个脚本或一次下载悄悄失效。这里有一条审计命令、一张修复表,和一条兜底的 CSP 指令。
- 10llms.txt 怎么写:模板、谁在发、以及它做不到什么llms.txt 怎么写?把最值得看的页面列出来、每条配一句说明。附格式、可填模板、30 个站的采用情况,以及它做不到的五件事。
- 11canonical 标签怎么写:三个信号,Google 按强弱读canonical 标签告诉 Google 同一份内容的几个网址里该留下哪一个。它是信号不是命令,会和跳转、sitemap 一起被权衡 —— 这里有可粘的两种写法、一段三行自检命令,和四种它会静默失效的写法。
- 12seo url 怎么起:官方六条规则,和一条把 sitemap 全跑一遍的命令seo url 的合格线是:能读懂的单词、连字符、参数尽量少、大小写只有一种。Google 把这写成抓取的前提条件,本篇给六条原话加一条能直接粘的自查命令。
- 13301 和 302 重定向怎么选:Google 只把其中一个当成换地址重定向该发 301 还是 302,决定的是哪个地址最后留在搜索结果里:Google 把永久码当成规范化信号,把临时码当成「老地址继续留着」。按场景的决策表、三条自检命令、以及出问题的三种样子。
- 14subdomain vs subfolder 怎么选:二级域名一挂上去,四样东西当场分家subdomain vs subfolder 是一次部署决定,有四条有文档支撑的后果:robots.txt 作用范围、抓取预算、Search Console 资源、sitemap 全都以主机名为界。四条里没有一条是排名。
- 15www vs non-www 怎么选:定一个主机名,然后让五个地方对上www vs non-www 定的是「这个站的主机名是哪一个」,不是排名问题。没有任何 Google 文档说过哪种更好。有文档的是:两个独立的 robots.txt 作用域、Search Console 里两个资源,以及跳转说清之前它们是一组重复网址。含决策表、四行自检和六行一致性表。
- 16结构化数据怎么加:哪几种还活着,哪两种已经下线结构化数据怎么加?HowTo 与 FAQPage 在 Google 已双双下线。这里是仍受支持的类型、四段可粘的 JSON-LD,以及会招致人工处罚的那条规矩。
- 17独立站要不要挂 article schema:Google 只读五个属性独立站的文章页要不要挂 article schema:要挂,但它换不来一个新的展示位。Google 官方只列了五个支持的属性,一个必填的都没有——这篇把每个属性该怎么写、缺了会怎样、以及它做不到什么,逐条对着原文说清楚。
- 18faq schema 还要不要挂:富媒体结果 2026 年 5 月已经没了faq schema 从 2026 年 5 月起不再产出 Google 搜索里的富媒体结果,一个月后文档也撤了。类型还在、校验照过,所以现在要判断的是这段标记还值不值得留 —— 这是判断的方法。
- 19rich results test 结果怎么读rich results test 只回答两件事:Google 能不能抓到并渲染页面,以及结构化数据够不够格拿到某一种富媒体结果。它不承诺结果会出现。这一篇给五步执行顺序、五行判读表,以及它帮不了你的那几处边界。
- 20product structured data 怎么写:独立站产品页的两套规则,先分清这一页能不能直接下单product structured data 动手前只有一个判断:这一页能不能直接下单。能下单按 merchant listings 那套写,测评页按 product snippets 那套写,两套的必填项互相不同。先用一条命令查你的 Shopify 或 WooCommerce 主题是不是已经在发,再看对照表、两段能粘的 JSON-LD 和三种最常见的写错法。
- 21关键词挖掘:手上还没有 Search Console 数据时,第一批词怎么选关键词挖掘在新站上只能靠三个不依赖自有流量的词源:下拉联想、结果页的追问、用户原话。每个词按五项打分,3 分才动笔。做出海站还要多防一层:你挖的是英文词,语感却是中文的。
- 22search intent 怎么判:一个搜索词到底在问什么search intent 就是打字搜一个词的人想干什么,它在动笔之前就决定了哪种页面能赢这个词。Google 那份评估员指南把意图分成四类:Know、Do、Website、Visit-in-person。要练的不是背这四类,而是在写之前先从结果页上把它读出来。
- 23search console verification 五种方法怎么选:托管平台上多半只剩两条路search console verification 是拿到 Search Console 数据之前的那一步。五种方法里只有 DNS 记录能验证 Domain property,其余四种各只覆盖一种协议加主机名的写法;托管平台会锁掉其中几扇门,但解析在你手上时 DNS 那条一直是通的。
- 24Search Console 效果报告:把四个数字读成五种形状这不是一篇 google search console 教程。效果报告给四个数字不给诊断——五种形状几乎覆盖一个页面能出的所有问题,每种的下一步都不一样。出海站还要先拆国家和资源类型两层。
- 25SEO 排名上不来:先分清是这六件事里的哪一件SEO 排名上不来通常是六个问题共用一句话,其中五个各自只要在 Search Console 里读一个数就能分开。这一章给出每个原因对应的那一个检查、跑它们的顺序,以及什么时候该停下。
- 26网站结构其实只由内链决定:一个话题一个落地页爬虫读不到你画的那张网站结构图,它只顺着 a href 走。所以能被抓取的网站结构由两个决定构成:每页指向谁、用哪几个字链过去。四列审计表、一段找孤岛页的命令、Google 自己的锚文本判据。
- 27a 标签怎么写:搜索引擎只读 href、文字和两种兜底a 标签上被搜索引擎读的只有三处:带 href 的元素、标签之间的文字、以及文字缺席时官方点名的两种兜底。三处各自会坏,坏法也不一样。
- 28面包屑导航怎么标:四个属性,和那个该省掉的面包屑导航只要一段 JSON-LD:一个 BreadcrumbList、至少两个 ListItem,每项带 position、name、item —— 加上官方明说最后一级可以省掉的那一个。
- 29dofollow 是个不存在的属性:nofollow / sponsored / ugc 三选一怎么标dofollow 在 HTML 里根本不存在,一条链接不写 rel 就是默认状态。真正要选的是 Google 文档里的三个值:sponsored、ugc、nofollow,按链接是什么来选。
- 30orphan pages 怎么找出来orphan pages 是站内没有任何页面链向它的页面。Google 仍能通过 sitemap 发现它们,但它们到达时没有锚文本、也没有位置。用一次集合差找出来,再把每个候选分诊成链接、合并、跳转或删除。
- 31geo 优化的第一步:四个引擎各自公开了什么,没公开什么geo 优化能做的第一件事不是写作技巧,是把管道接对。四个引擎没有一家公开过排序逻辑,但每家都公开了哪个爬虫喂哪个取材面——本篇给那张对照表和五步就绪检查。
- 32google 相关问题:把别人问出口的那句原样抄下来要进 google 相关问题那个框,先做一件枯燥的事:抄下别人真打出来的那句话,给每个问句指定唯一一个页面,再把它做成 H2,答案写在下面。
- 33ai 搜索优化:被摘走的是一节,不是一整页ai 搜索优化在排版这一层只答一个问题:能回答问题的那段文字从哪儿开始到哪儿结束。六条可核对的结构规则,外加一条中文独有的:把「铺垫」倒过来写。
- 34semantic html 怎么写:页面每一块该用哪个元素,爬虫才读得懂semantic html 就是给页面每一块区域起一个名字,爬虫在读懂你的文字之前,先读出这棵文档树。这一章给的是「哪一块用哪个元素」的对照表、一条能对任何网址跑的审计命令,以及一个我们不会给的承诺——Google 明说搜索「can rarely depend on semantic meanings」,所以标记是正确性问题,不是排名杠杆。
- 35h1 tag seo:Google 明说层级顺序不影响排名,那 h1 还要不要管h1 tag seo 一页只需要做一个决定:哪一个标题在给整页命名。Google 写过标题层级顺序不影响 Search、也没有理想的标题数量,却把标题元素列进了它拼搜索结果标题的九个来源里。一条自查命令、一张七行判读表、三个值得改的地方。
- 36title tag seo:Google 能从九个地方替你取标题,七种情形下会换掉你写的title tag seo 处理的是一件不对等的事:标题你写得了,显示出来的那一行 Google 说了算。官方列了九个来源和七种它会替你改写的情形。一条把四个字段拉出来对账的命令,一张七症状判读表,外加出海站最常踩的那一条。
- 37seo 标题和描述怎么写:没有字数上限,但有两种角色seo 标题和 meta description 都没有字数上限,Google 文档写得很清楚。真正要分清的是角色:标题你说了算,摘要只能影响。六行发布前自查,每行对应官方原句,外加 27 个首页的实测。
- 38图片 alt 怎么写:Google 读的是哪几样,四种情况该留空图片 alt 是给看不见这张图的人写的一句描述,不是关键词位。四类图片正确写法是留空,而把属性整个省掉说的是另一件事。附六行发布前自查表与一段找缺属性的命令。
- 39seo 图片怎么做:六个属性,搜索引擎只读其中两个seo 图片落到一个标签上只有六个属性,搜索引擎真正会读的只有两个:alt 文字和文件名。另外四个管的是图片多快到达、加载时页面会不会跳一下。
- 40og image 怎么配:一张 1200 × 630 打通所有分享入口og image 的尺寸只有一个答案,能一次满足所有分享入口:1200 × 630 像素,JPG 或 PNG,小于 5 MB。这一张图同时越过 Meta 推荐的尺寸线和 X 卡片的限制,还能充当两边的兜底。
- 41竞品对比页怎么写,才会被引用而不是被跳过竞品对比表能被引用,靠的是每一行都是别人能自己核的事实。这一章给出八块页面骨架、四类断言各自的取证规则,以及两种不该建这个页面的情况。
- 42品牌词:让答案引擎说对你是谁品牌词在答案引擎这边的问题是消歧:它得先确定这个名字指的是谁。落地是一块结构化数据、一串你控制得住的资料页,和把名字在七个地方写成同一个样子。
- 43author schema:出海站的这篇文章,到底是谁写的author schema 是把一篇内容挂到一个具体人名下的那个属性。这里有可以直接粘的 JSON-LD、名字必须一字不差的七个地方,以及它换不来的东西。
- 44indexnow 怎么用:一个 key、一次请求,把更新直接告诉引擎indexnow 要三样东西:一个 key、把它挂成文本文件、每次发布发一个请求。全程不用登录任何搜索引擎后台,本篇给全套步骤、五档回执判读表和一段可直接粘的推送脚本。
- 45url inspection 逐行怎么读:默认那份不是实时的url inspection 默认给你看的不是实时页面,而是 Google 上次收录时的记录。十来行里真正决定结果的只有三行 —— 这是逐行读法、四种判定各自的下一步,以及 canonical 不一致时的五步排查顺序。
- 46bing 站长工具怎么用:五选一验证,和那份能数出 AI 引用次数的报告bing 站长工具免费,五种验证方式挑一种就能加站。真正值得多开一个后台的是 AI Performance 报告:它数的是你的页面被 Copilot 和 Bing 的 AI 答案引用了多少次。
- 47page indexing report 怎么读:一次读一条原因page indexing report 是唯一能一次性告诉你 Google 把哪些页面漏在外面、各是什么原因的地方。当两个问题读:你在乎的页面在已编入索引那一桶吗,未编入索引那桶里每条原因是不是你自己选的。含十行分诊表,每行都是 Google 自己的定义。
- 48remove url from google:先分清是你的页面还是别人的,四种情况各用哪个工具、能管多久remove url from google 其实是四件事。自己的页今天就要没:Removals 工具,一天内生效,管六个月左右。自己的页永久没:404 或 410、密码、或一条爬虫读得到的 noindex。别人的页:Refresh Outdated Content 表单。一张路由表、一段发请求前先跑的三十行自检(按 Google 的 robots.txt 优先级判路径)、六种悄悄失败的做法。
- 49网站地图怎么写:四个字段,Google 有两个根本不看网站地图是一份放在站点根目录的 UTF-8 文件,列着你希望被搜到的完整网址。四个字段里 Google 明说有两个不看,第三个只有经得起和页面比对才算数 —— 这里有可粘的两份 XML、一段清点命令,和四种常见写法错误。
- 50sitemap index 什么时候该拆,怎么写sitemap index 列的是其他 sitemap 而不是页面。Google 的硬线是 50,000 个网址或未压缩 50MB,但多数站该更早就拆 —— 按你以后想读覆盖数字的那条线拆。这一篇给模板、限额表和四种安静的出错方式。
- 51utm 参数怎么打:九个里三个必写,两个写了也不进报表utm 参数是挂在链接后面的标签,统计工具靠它说出访问从哪来。Google Analytics 认九个,三个每次都要写,两个收下之后哪张报表都不显示;平台自动带的 gclid、fbclid 是另一套东西,别混着写。
- 52直接流量:把 AI 带来的访问从这个桶里捞出来直接流量是 GA4 给「没人告诉它从哪来」的会话起的名字,AI 助手的点击经常落在这里。这里是把一部分捞回来的配置,以及捞不回来那部分的老实交代。
- 53search console api 怎么用:四个服务、两个域名,和那个值得为它接一次的行数上限search console api 免费,返回的就是界面上的同一批数字,值得为它接一次的差别只有一个:一次请求 25,000 行而不是一千行。它是两个域名上的四个服务,认证走 OAuth 而不是 API key,配额按请求形状扣,不按调用次数扣。
- 54pagespeed insights api 怎么用:一份 JSON 里有两套数据,其中一套正在搬走pagespeed insights api 一次请求返回两套互不相干的数:真实 Chrome 用户量出来的实测数据,和 Lighthouse 跑一次的实验室数据。这篇讲清哪一块是哪个、两个最容易漏的参数,以及实测那一半正在搬去哪个端点。
- 55舆情监测换个打法:一组固定提示词,手工盯住 AI 答案里的你舆情监测不一定要买系统。用 20 条写死的提示词,每月 40 分钟数一遍 AI 答案里有没有你 —— 提示词集怎么建、七列记录表长什么样、哪四种情况会让两轮不可比。
- 56老页面该更新还是删掉:先分成四档,再动手老页面该更新还是删掉,卡的是分诊这一步。刷新、合并、差异化、删除是四种不同操作——本篇给按证据分的判读表,以及每一档判完必须补上的三件事。
- 57多语言网站先定语种:翻哪几种、按什么顺序、哪些页不翻多语言网站贵的决定不在 hreflang 标签上,在它之前。这一章给出四项打分的语种排序法、该翻与不该翻的六种页型对照表,以及六条全部有官方原文出处的 hreflang 自查。
- 58hreflang 标签怎么写:三处落点、x-default、与那条会让整组作废的回指规则hreflang 是一组只能成组生效的标签:每个语言版本都要列出包括自己在内的全部版本,只要缺一条回指,Google 可能把整组一起忽略。这篇讲取值怎么写、三处落点怎么选,以及一条发布前验回指的命令。
- 59resource hints 怎么用:preload、preconnect、dns-prefetch 各管什么,别一把梭resource hints 是让浏览器在发现资源之前就知道它的那几行 <link>。这篇讲五种提示各管什么、一张能直接照抄的决策表,以及一条命令查出你页面上已经发了哪些。
- 60largest contentful paint:先量再拆,修占比最大的那一段largest contentful paint 是视口里最大那块内容渲染完成的时间,目标是 2.5 秒以内。这篇讲怎么找到那个元素、把它拆成四个子部分、并只修占比最大的那一段。
- 61interaction to next paint 怎么优化:先量出最慢的那次交互,再拆延迟interaction to next paint(INP)量的是页面响应一次点击、轻触或按键要多久,合格线是 75 分位的 200 毫秒以内。这一章教你先找出最慢的那次交互,再拆开延迟、只修占大头的那一块。
- 62cumulative layout shift 怎么查怎么修:四步把乱跳的内容按住cumulative layout shift 是衡量视觉稳定性的那个 Core Web Vital,第 75 百分位要不高于 0.1。这一章给你四步查法:先跑分数,再到审计里点名会动的元素,最后把它的空间提前占住,附一条可复现的命令。
- 63render blocking resources:先找出挡住首屏的那些,再决定修哪个render blocking resources 是浏览器在画出第一个像素之前必须先下载并处理的样式表和脚本。这一章教你先把它们列出来、把真正花钱的挑出来,再用两种改法把等待挪走——附一条对任意网址都能跑的列清单命令。
- 第 3 阶
进阶
取舍、常见的失败场景,以及线上网站的实测数据。
- 1AI 流量在 Search Console 里能看到什么:一份只有曝光的报告搜 AI 流量的人想要访问量,而 Search Console 的生成式 AI 报告里一个访问数都没有。它只有曝光,没有搜索词,AI Overviews 和 AI Mode 还合并成一个数。这一章讲它答得了什么,剩下的怎么在页面层面自己拼。
- 2外链之外:AI 答案里的「被提及」是另一套东西外链数的是边,AI 答案里起作用的是句子。答案引擎只会说出它见过别人说过的名字 —— 能替你写那句话的站外页面只有五类,其中一类花钱买不到。
- 3长尾关键词:三个信号说明该放弃,一个说明还值得试长尾关键词真正的问题不是难度多少算高,是什么时候该放弃。结果页被谁占着、标题命中比值、有没有人真在搜——三件你自己看得见的事,就够做这个决定。
- 4内容重复:不是抄袭,是你两个页面在抢同一个意图搜内容重复出来的都是查重工具,那说的是抄袭。这一章讲你自己两个页面互抢:它没有惩罚,代价是权重被劈开、页面由 Google 替你选。这里是定位法和三选一的修法。
- 5流量来源对不上:两个后台各说各话时,怎么算出一个数流量来源在 Search Console 和分析工具里从来对不上,因为两边没有共同的主键。把每一步关在一个系统里量,把差额记成一个常数,报数时连四个输入一起报。
- 6要不要屏蔽 ai 爬虫:这是三个决定,不是一个要不要屏蔽 ai 爬虫拆开是三件事:AI 搜索收录、模型训练、用户触发的抓取。本篇给决策树、三类站各自的口径,以及为什么成本那一侧我们暂时算不出来。
- 7noindex 什么时候该用:写了不生效,多半是 robots.txt 挡住了noindex 让页面照常能打开、但不进搜索结果 —— 前提是爬虫被允许抓到它。在 robots.txt 里屏蔽掉这个网址,等于让这条规则永远没机会被读到。这里有四种工具的判读表、两种可粘写法,和一个从 robots.txt 查起的排查顺序。
- 8data-nosnippet 与另外三条:一个页面能被摘走多少,是可调的data-nosnippet 是四条摘要控制规则里唯一作用在页面局部的一条。这里逐条给出它们各自挡掉什么、哪两条同时限制 AI Overviews 与 AI Mode,以及为什么多数站一条都不该设。
- 9Shopify SEO 做不到的那几件事:托管平台替你定的五层Shopify SEO 的上限由五层决定:完全归你的只有一层,一半开放的两层,剩下两层永远拿不到。这一章把五层点名,给出各自的替代做法,把换平台放在最后。
- 10crawl budget 到底归不归你管:Google 自己给了两条门槛crawl budget 真的存在,而 Google 说绝大多数站不该操心它。两条规模门槛加一个 Search Console 状态决定它归不归你管,本章给四步自查和按成本重排的修法清单。
- 11core web vitals 值不值得做:两处有文档支撑的影响,和一个该看的数core web vitals 是排名系统读的一个信号,和其他信号并列;服务器响应慢则直接减少 Google 抓你的量。速度影响 SEO 的两条路径分属两个系统,都不会把慢页面变成更好的答案。
- 12faceted navigation:哪些筛选网址该放给爬虫,哪些该关掉faceted navigation 里的筛选网址值不值得被抓,只看有没有人在搜它筛出来的那个东西。Google 写明的四种机制里只有两种拦得住抓取。这里给五类筛选网址的判读表,以及一套上线前逐条跑过的 robots.txt 规则 —— 外加托管平台上你还剩哪几种机制。
- 13翻页怎么做:每一页留住自己的网址,canonical 绝不指回第一页pagination seo 只有一条规则:序列里的每一页都是独立的一页。给它自己的网址、让 canonical 指向自己、从上一页给它一条真链接。五步有序 SOP、一段可粘的 head 块、一张五行判读表和三条 curl 自检。
- 14怎么让服务器回 304 not modified:一次重访只花一次响应头304 not modified 是服务器回一句「什么都没变」,而且没有正文。Google 支持两对校验头、明确偏好 ETag,并公布它的抓取里只有 0.017% 可缓存。四步 SOP、一段两次请求的自检、一张五行判读表。
- 15google 收录要多久:四个阶段四个钟,只有一个有公开数字google 收录要多久其实是四个问题。官方只给了抓取的区间,并明写请求抓取不保证收录。本篇给四阶段的证据来源和一张停手判读表:什么时候该断定再等也没用。
- 16google indexing api 只认两类页面:其余的该走哪条路google indexing api 只收两类页面 —— 招聘岗位和直播活动,其余一概不认。这是资格自测、配额的真实口径、插件为什么说得不一样,以及对所有人开放的三条替代路线。
- 17301跳转之外:改一次页面,还会连带砸坏的四处301跳转只挡住了改地址的第一处风险。canonical、内链、结构化数据、标题——另外四处都不出声。这一章给动手前要锁住的六行、七步顺序,和五行回滚判读表。
- 18页面删掉之后该返回什么:404 页面、410,还是这两个都不该用404 页面到底该返回 404 还是 410?对 Google 来说这不是选择题——除 429 外所有 4xx 一视同仁。真正改变结果的是在 4xx、301 和 503 之间选错哪一个,本章给三问决策与一条自查命令。
