sitelinks search box 实测 27 个首页:7 个站还留着一个已下线功能的标记
Google 已在 2024-11-21 全球下线 sitelinks search box。2026-09-06 抓取的 27 个首页里,仍有 7 个在声明喂它的那条搜索动作 —— 换成有资格声明的分母是 7 / 13。而同一个 WebSite 对象上仍受支持的站名那一半更薄:13 个里只有 2 个写了 alternateName,还有 1 个把主机名填在了站名字段里。

实测 · 2026-09-06 · 27 个首页 · 每站一次请求 · 一个已下线搜索功能的标记
样本 / 口径:2026-09-06 当天对 30 个首页各发一次 GET,桌面 Chrome UA,跟随跳转,不执行 JavaScript,出口在日本。stackoverflow.com、medium.com、www.reddit.com 三个站返回 403,剔除后纳入 27 个。只解析 JSON-LD,microdata 与 RDFa 没读。
不少出海站的首页里躺着一块 sitelinks search box 标记,多半是几年前主题或插件顺手贴进去的。Google 已经在 2024-11-21 把这个功能全球下线,这 27 个首页里还有 7 个在声明它。分母是 13 不是 27:只有 13 个站声明了 WebSite 对象。而同一个对象上还在生效的那一半,站名,写得比退役的那一半更薄。
怎么测的
每个站一次 GET,用桌面 Chrome UA 而不是 Googlebot,跟随跳转,正文全部落盘。从每份落盘的页面里取出所有 application/ld+json 块,按 JSON 解析,在图里找类型为 WebSite 的对象,逐站记四件事:有没有声明搜索动作、它的目标怎么写、搜索词输入项怎么写、name 与 alternateName 各是什么。
# 在你自己的首页上读同样四件事
curl -sL -A 'Mozilla/5.0' https://example.com/ > home.html
grep -c 'application/ld+json' home.html
grep -c '"WebSite"' home.html
grep -c 'SearchAction' home.html
grep -c 'alternateName' home.html
找到的块全部解析通过,27 个首页零解析失败。这条值得单独说一句:大家预期的故障就是 JSON-LD 写坏了,而这次一次都没发生。
四条局限,每一条都会改变你怎么读上面这些数。每站只请求一次,而且只请求首页,首页不等于一个站。不执行 JavaScript,所以标签管理器或前端框架在运行时注入的结构化数据在这里看不见,光这一条就可能解释掉「什么都没有」的那 10 个站里的一部分。只解析了 JSON-LD,microdata 和 RDFa 一个都没读。还有最要紧的一条:HTML 里声明了,不等于 Google 为这个站展示了什么 —— 我们没查任何一条真实搜索结果,也没法从一次抓取里分清一条搜索动作是没人管的遗留,还是刻意留着的。
删不删之前,先分清你在哪一类
7 / 27 听起来很少,换成 7 / 13 就是一半。只有 13 个站声明了 WebSite 对象,剩下 14 个连放这块标记的位置都没有,所以后一个分母才是有意义的那个。
| 分组 | 首页数 | 有资格声明 |
|---|---|---|
| 完全没有 JSON-LD | 10 / 27 | 否 |
| 有 JSON-LD,无 WebSite | 4 / 27 | 否 |
| 声明了 WebSite 对象 | 13 / 27 | 是 |
什么都没有的那 10 个是 developer.mozilla.org、linear.app、news.ycombinator.com、substack.com、www.wikipedia.org、slack.com、www.notion.com、github.com、astro.build、react.dev。有 JSON-LD 却没有 WebSite 对象的 4 个里,www.figma.com 和 www.framer.com 只声明了 Organization,www.bbc.com 声明的是一个新闻机构类型加一个页面类型,vercel.com 一口气声明了八种类型,里面没有 WebSite。
7 个首页还在声明 sitelinks search box 的那块标记
27 个里有 7 个在 WebSite 对象里带着一条搜索动作:railway.com、arstechnica.com、techcrunch.com、www.nytimes.com、www.cloudflare.com、www.wired.com、www.theverge.com。五个是内容站,两个卖基础设施,七个都是在这个功能下线将近两年之后,仍然把它投递在首页上。
Google 是 2024-10-21 发的下线公告:「we'll be removing this visual element starting on November 21, 2024」(Farewell, Sitelinks Search Box,Google Search Central,2026-09-06 访问)。同一篇写明这次变更「will apply globally across all search results, in all languages and countries」,也写明它「doesn't affect rankings or the other sitelinks visual element」,并且 Google 会「remove the Search Console rich results report for it and stop highlighting the markup in the Rich Results Test」。报告没了,测试工具里也不再高亮它,页面上的标记还在。
| 站点 | 目标写法 | 搜索词输入项 | 目标路径 |
|---|---|---|---|
| railway.com | EntryPoint | 字符串式 | /deploy?q={search_term_string} |
| arstechnica.com | EntryPoint | 字符串式 | /search/{search_term_string}/ |
| techcrunch.com | EntryPoint | PropertyValueSpecification | /?s={search_term_string} |
| www.nytimes.com | EntryPoint | 字符串式 | /search?query={search_term_string} |
| www.theverge.com | EntryPoint | 字符串式 | /search?q={search_term_string} |
| www.cloudflare.com | 纯字符串 | 字符串式 | /search?q={search_term_string} |
| www.wired.com | 纯字符串 | 字符串式 | /search?q={search_term_string} |
七个站三种写法,还有一个目标压根不是搜索页
七个里有五个把目标包在 EntryPoint 对象里,两个直接给一条字符串;六个的搜索词输入项还是老的字符串写法,只有 techcrunch.com 用了对象写法。这两栏加起来,七个站凑出三种组合,也没有什么力量把它们拽到一起 —— 读它的那个东西不读了,格式就会这样散开。
七个里还有一个的目标不是搜索页。railway.com 那条模板落到的是它的 deploy 页,不是一页搜索结果,另外六个都指向自家主机上真实的站内搜索路径。这是一次没写完的粘贴,还是刻意把一个不再渲染的位置挪作他用,我们从一次抓取里分不出来。只知道 2026-09-06 这天首页上写的是这样。
标记会比读它的那个功能活得久,因为没有人会给你的首页发一封下线通知。
还在生效的那一半:website schema 与 Google 站名
下线公告的最后一句其实是给站长留的路标:「If you decide to remove sitelinks search box structured data, note that site names also uses a variation of WebSite structured data, which continues to be supported.」同一个 WebSite 类型换了个活干,而这个活还在。站名那篇文档说得更直接 ——「To indicate your site name preference, add WebSite structured data to your home page」(Provide a site name to Google Search,Google Search Central,2026-09-06 访问)。
站名就是结果里显示在你页面上方的那个名字:「When Google lists a page in search results, it shows the name of the site the page comes from. This is called the site name.」对出海站来说,这一栏比一条已经没人读的搜索动作值钱 —— 它决定海外用户在结果页上看到的是你的品牌名,还是一串域名。
而在这 27 个首页上,还在生效的这一半比退役的那一半更薄。13 个 WebSite 对象里只有 2 个写了 alternateName:techcrunch.com 写的是「TC」,www.nytimes.com 写了四项 —— NYT、new york times、nytimes、ny times。另外 11 个给了个名字就结束了。13 个里还有一个 about.gitlab.com,它 name 字段里放的就是字符串 about.gitlab.com,那是主机名,不是站名。
| 站名这一半 | 站数 |
|---|---|
| 人能读懂的名字 | 12 / 13 |
| 拿主机名当名字 | 1 / 13 |
| 写了 alternateName | 2 / 13 |
| 声明了搜索动作 | 7 / 13 |
出海站最容易漏掉的两处
一处是 name 写成了域名。Google 说站名的生成是「completely automated and takes into account content from a site's home page and references to it that appear on the web」,而 WebSite 结构化数据「is most important, if you want to specify a preference」。把主机名填进这一栏,等于把一次表达偏好的机会又还给了自动系统。
另一处是没写 alternateName。文档写明这个字段就是给「首选没被选中」这种情况准备的:「While we can't manually change automatically selected site names, you can indicate alternatives for our automated system to consider if your primary preference isn't selected.」出海站常见的状况是正式英文名、日常简称、域名三个说法并存,而 13 个站里只有 2 个把并存的说法写了出来。同一页还给了一条边界:名字要「accurately reflects the identity of your site and isn't misleading for users」,所以这一栏不是堆词的地方。
{
"@context": "https://schema.org",
"@type": "WebSite",
"name": "Example",
"alternateName": ["Example Docs", "example.com"],
"url": "https://example.com/"
}
这对你意味着什么
先回答那个真问题:不用删。Google 把话说得很死 ——「While you can remove sitelinks search box structured data from your site, there's no need to do so. Unsupported structured data like this won't cause issues in Search, and won't trigger errors in Search Console reports.」删了不会掉东西,不删也不会被扣分。真正值得花时间的是同一块 JSON-LD 里另外几行。
- 打开首页源码找
WebSite对象。找不到才是真的缺口 —— 这 27 个首页里有 14 个是这个状态,一个退役特性从来不是它们的问题。 - 用陌生人的眼睛读一遍
name。这个面板上有一个站,那一栏放的是自己的主机名,而那正是自动系统在没人帮忙时会猜出来的东西。 - 品牌有别名就补
alternateName。13 个站里只有 2 个补了,而 Google 文档写明这个字段就是给「首选可能落选」准备的。 - 那条搜索动作别专门去删。除非你本来就要改这块 JSON-LD —— 删掉换不来 Google 描述过的任何好处,而改坏一块线上 JSON-LD 的代价,比留着一个死属性大。
- 要留就顺手看一眼目标指向哪。这七个里有一个指的不是搜索结果页,而且不会有人发现,因为已经没有东西去渲染它了。
现在还值得挂哪些类型,写在 结构化数据还有哪些类型值得挂;同一块 JSON-LD 里「谁在发布这个站」的那一半,数在 27 个首页的 organization schema 实测。想看自己的首页在任何脚本运行之前投递了什么,可以 看看 QueryWin 从一个首页里读出什么。
常见问题
你们是怎么测的
2026-09-06 当天,30 个首页各发一次 GET,桌面 Chrome UA,跟随跳转,正文落盘。从投递 HTML 里取出 JSON-LD 块并解析,读类型为 WebSite 的对象的 name、alternateName 与搜索动作,逐站记下目标与输入项的写法。全程不执行 JavaScript。出口在日本。30 个里有 3 个返回 403,在统计前剔除。
主题里那块 sitelinks search box 标记要不要删
不用。Google 明说这类已不受支持的结构化数据「won't cause issues in Search, and won't trigger errors in Search Console reports」。如果你本来就在重写那块 JSON-LD,顺手删掉也没有代价。两种做法各自的后果我们都没有数据 —— 这次只测了站点声明了什么,没测声明之后发生了什么。
这个功能后来恢复过吗
按 Google 公开写过的东西,没有。2024 年那篇公告说下线「will apply globally across all search results, in all languages and countries」。本次测量一条真实搜索结果都没查,所以这一点我们靠的是公告,不是观察。
website schema 现在还有用吗
有用,用在站名上。Google 文档直接点名:「To indicate your site name preference, add WebSite structured data to your home page.」同一页也提醒你写进去的是偏好不是设定值 ——「we can't manually change automatically selected site names」。
为什么有 10 个首页一点 JSON-LD 都没有
我们不知道。这次抓取不执行 JavaScript,一个在运行时注入结构化数据的站在这里就是空的,这 10 个里多半有一部分属于这种情况,而不是真的什么都没发。一次请求分不开这两者。


