禁用 JavaScript 之后,网页还剩什么:27 个首页 61 个 noscript 块
禁用 JavaScript 之后页面退回到 noscript 里那点东西。27 个首页一共 61 个块:47 个只有一张图,5 个是埋点 iframe,4 个有文字,真正给了一份可点导航的只有一个。

实测 · 2026-08-26 · 27 个首页 · 单次抓取 · 只看原始 HTML
样本 / 口径:2026-08-15 起一直在用的那 30 个站,2026-08-26 各抓一次,浏览器 UA,不渲染、不重试。数的是原始 HTML 里 <noscript> 块的个数,以及每一块里装了什么。
把浏览器里的 JavaScript 关掉,页面会退回到 <noscript> 里那点东西。27 个首页一共只有 61 个这样的块:47 个里只有一张图,5 个是埋点 iframe,4 个有文字,其中 3 个装的是样式表。真正给了一份可点的导航的,全样本只有一个。禁用 JavaScript 之后能看到什么,多数站根本没安排过。
怎么测的
每个站一次 HTTP 请求。纳入规则跑数前就写死:最终状态 200、解压后正文不少于 10,000 字节、正文里含 <body。30 个站里 3 个没过 —— stackoverflow.com 与 medium.com 返回 403,www.reddit.com 返回了一个 8,393 字节的空壳,剩下 27 个,和前几批被剔掉的是同样三个。
27 份正文全部落盘,下面每个数字都是从落盘的字节里重算的。这一步这次救了一条结论:那 47 个「只有一张图」的块,初稿写的是「跟踪像素」,回原始 HTML 一看完全相反 —— 装的是带描述文字的产品截图和文章缩略图。
# 任何一个页面都能这么数一遍
curl -sL -A 'Mozilla/5.0' https://example.com/ \
| grep -o '<noscript[^>]*>.\{0,300\}' | head -20
两条局限写在前面。一是我们只量了「发出去的是什么」,没量「有没有人真去读」;二是只抓了首页,首页没有不代表内页也没有。
61 个块,两个站占了 47 个
27 个首页里 12 个至少有一个块,15 个一个都没有。分布很偏。
| 站点 | 块数 | 里面是什么 |
|---|---|---|
canva.com | 26 | 每块一张产品图 |
nytimes.com | 21 | 每块一张文章缩略图 |
bbc.com | 3 | 两块样式,一块导航 |
webflow.com | 2 | 样式,加埋点 iframe |
theverge.com | 2 | 一空块,一张图 |
| 另外 7 个站 | 各 1 | 多数是标签管理器 |
换成按内容数,结论更干脆。
| 块里装的 | 块数 |
|---|---|
| 只有一张图 | 47 |
| 埋点 iframe | 5 |
| 空的或只有属性 | 5 |
| 有任何文字 | 4 |
那 47 张图不是凑数,是懒加载的兜底
脚本决定去取哪几张图,<noscript> 里那份就是脚本没跑起来时剩下的那份。Canva 的块里,alt 写的是「一组自然、抽象与生活方式的视频素材缩略图」这种给人看的句子,不是给统计用的。
所以这个元素在 2026 年最常见的真实用法,不是那句「请开启 JavaScript」,而是一份图片副本 —— 而且是不渲染的客户端唯一能拿到的那一份。删之前先知道这件事。
只有一个站在 noscript 里放了导航
bbc.com 的第三个块有 20,659 字节。里面是一个 <details> 包着 75 条链接:Home、News、Sport、Business 一路排下去,class 名直接写着 NoJsNavigation。把脚本关掉,这个站照样能走到下一页。
全样本 27 个站、所有块加起来一共 76 条链接,其中 75 条在这一个块里。
空的 noscript 不是兜底,是一个留出来没人填的位置。
禁用 JavaScript 之后,你的页面还剩什么
做出海站的人这里有个容易误判的地方:Google 用无头浏览器渲染,所以这个元素对 Google 基本无关紧要。但会来取你页面的不止 Google。有几类检索客户端只取原始 HTML、不跑脚本,对它们来说原始 HTML 就是全文。本站此前实测过前端渲染的站上 AI 爬虫实际拿到多少字,同一个页面按来访者不同,从 342 字符到 25,082 字符都有。
- 图片兜底留着。它是你能给不渲染客户端的最便宜的一段文字,alt 还是白送的
- 导航如果是脚本生成的,在 noscript 里补一份纯链接列表。bbc.com 证明这条做得到
- 别发空块,也别只写一句「本站需要 JavaScript」。那等于一个没有内容的页面加一块说明牌
- 别拿它当服务端渲染的替代品。它只补一个元素,不是一套方案
动手之前先看一眼从你服务器发出去的是什么。查一遍爬虫从这个页面收到了什么看的是原始 HTML 而不是渲染结果;手册里AI 爬虫会不会执行 JavaScript 那篇给了数正文字符数的命令。
常见问题
你们是怎么测的
2026-08-26 每个首页一次请求,浏览器 UA,正文落盘,用 HTML 解析器数块,每个要发的数字再回落盘文件里按字节搜一遍核对。不渲染、不重试、一个出口位置。
Google 会读 noscript 里的内容吗
Google 用无头浏览器渲染页面。按 HTML 规范,脚本可用时这个块里的东西被当作文本而不是标记处理。所以对 Google 来说算数的是渲染后的页面,这个元素是给已经能跑的东西做兜底。
一个 noscript 都没有,是不是有问题
27 个首页里 15 个一个都没有。如果你的 HTML 在任何脚本跑起来之前就已经带着正文,那就没有什么要兜底的,也没什么要补。
为什么这些站是几十个块而不是一个
因为用它的站是按图片用的,不是按页面用的。Canva 有 26 个,是因为它有 26 张懒加载的图。块数多少说明不了不渲染的客户端能拿到多少字。
能在里面塞一段关键词吗
能,但那会变成一段只对跳过脚本的客户端出现的文字 —— 那就是给爬虫看的和给人看的不一样。按没有脚本的人真正需要什么来写,写完就停。


