h1 标签:27 个首页有 6 个一个都没有,而且病因是两种

h1 标签是页面说明「这一页讲什么」的唯一元素。2026-08-17 读的 27 个首页里 6 个一个都没有——而且 HTML 是 3 KB 还是 938 KB,决定了修法完全相反。

排名与引用4 分钟读完939 次阅读
h1 标签:27 个首页有 6 个一个都没有,而且病因是两种

实测 · 2026-08-17 · 30 个站 · 单次快照

样本与口径:与我们做 robots.txt、sitemap 两次调查完全相同的 30 个站。每站首页一次请求,浏览器 User-Agent,2026-08-17。3 个站拒绝了我们,分母是 27。同一次抓取供本批另外四篇用。

h1 标签是页面用自己的标记说「这一页讲什么」的唯一那个元素。27 个首页里有 6 个一个都没有:The Verge、BBC、TechCrunch、Substack、Hacker News、Canva——都不是小站。另有 3 个发了两个。剩下 18 个正好一个。

谁没有,以及它们的 HTML 有多大

字节数那一列才是重点,它把这 6 个站劈成了两个完全不同的问题。

站点h1 数交付的 HTML
theverge.com0938 KB
bbc.com0614 KB
techcrunch.com0464 KB
substack.com0217 KB
news.ycombinator.com035 KB
canva.com03 KB

怎么测的

故意做得很粗,且在抓取前就写死了。

  1. 用桌面浏览器 User-Agent 请求首页一次,跟随重定向。
  2. 在交付的 HTML 里数 <h1 后面跟空白或 > 的出现次数。
  3. 同时记下这份 HTML 的字节长度。

数的是标签,不是看得见的标题。被 CSS 藏起来的 h1 照样计入,而样式做得像标题、标记却是 div 的那种不计入。

🔴 同一个症状,两种病,修法相反

Canva 交付了 3 KB。那不是一个页面,是一个加载器——没有 h1、没有 description、没有 canonical、没有结构化数据,因为这些在 JavaScript 跑起来之前都不存在。任何不执行页面的东西看到的就是一个空壳。

The Verge 交付了 938 KB,照样没有 h1。内容明明就在 HTML 里,只是模板从没把其中任何一段提升成顶级标题。那是个模板决定,不是渲染问题,改一行就好。

Hacker News 卡在中间:35 KB 手写 HTML,比这场讨论本身还老。它的内容完全可读,只是压根不用标题元素。

这个区分对做出海站的人特别要紧,因为国内团队用 Next.js、Framer 或自研 SPA 的比例很高,很容易撞上 Canva 那一支。前端渲染那一支要动的是渲染方式,模板那一支只是把 div 换成 h1——两件事的成本差着数量级。爬虫到底会不会替你执行 JavaScript,我们在ai 爬虫会执行 javascript 吗里量过。

3 个站发了两个 h1,这不算错

Stripe、Webflow、Cloudflare 各发两个。HTML5 规范允许在分节内容里出现多个 h1,所以没有任何东西坏掉。

代价是精确度。一页只有一个 h1,引擎对「这一页讲什么」就只有一个候选答案;有两个,它得挑,而挑哪个不由你决定。首页上同时挂着产品主标题和一条活动横幅时,这个选择并不显然。

为什么这件事对 AI 答案比对排名更要紧

标题结构是提取式系统找「可摘段落边界」的依据。一个答案引擎要从你的页面上摘一句结论,得知道哪一块文字属于哪个问题,而标题是这件事上最便宜的信号。

这句是推理,不是测量结果。我们没有测过被引率和标题结构的关系,也不打算暗示一个手上没有的数字。

这次没查的

只看了首页,而首页是多数站上最不具代表性的一页。文章页几乎肯定不一样——The Verge 的单篇报道很可能是带 h1 的,尽管它的首页没有,这次抓取看不到那一层。

我们也说不了这 6 家会不会在前端补上 h1。Canva 几乎肯定会。会执行 JavaScript 的引擎届时能不能看到它,是另一个我们没测的问题。

怎么查自己的 h1 标签

一条命令就能答,而且比看渲染后的页面可靠——这个问题恰恰就藏在那个差别里。

  • 用 curl 取一次页面,数 h1 标签。curl 数出 0 而浏览器里明明有标题,说明它是交付之后才加上的。
  • 一页保持一个 h1,而且让它说「这一页是什么」,不是说品牌名。
  • 别指望爬虫替你跑 JavaScript 去找那个标题。
  • 别把 div 做成标题的样子。人看着没问题,解析器完全看不到。

我们之前抓自有 5 个站时,正好发现有 1 个首页没有 h1,那篇是ai 爬虫实际读到了什么,本篇是那条观察的扩样版。把这项检查在每一页上跑一遍、而不是只看首页,正是 QueryWin 在做的事。

常见问题

没有 h1 标签会被降权吗?

没有任何公开的处罚规则,我们也没测排名。它是少了一个信号,不是触发了一次惩罚——这种代价更小、更含糊,也更不容易被发现。

能不能放两个 h1?

规范允许,这里也有三个站在这么做。代价是你不再有一个显而易见的答案来回答「这页讲什么」。

h1 必须和 title 一样吗?

两者面向的读者不同——title 给结果页看,h1 给页面本身看。让它们靠近是为了别自相矛盾,完全一致并不是要求。

h2 以下呢?

那些把页面切成小节,而提取真正倚重的就是这一层。只有 h1 没有任何 h2 的页面,等于有名字但没有内部结构。

h1 标签:27 个首页有 6 个一个都没有,而且病因是两种