subdomain vs subfolder 怎么选:二级域名一挂上去,四样东西当场分家

subdomain vs subfolder 是一次部署决定,有四条有文档支撑的后果:robots.txt 作用范围、抓取预算、Search Console 资源、sitemap 全都以主机名为界。四条里没有一条是排名。

抓取与收录6 分钟读完1531 次阅读
subdomain vs subfolder 怎么选:二级域名一挂上去,四样东西当场分家

subdomain vs subfolder 是一次部署决定,它对搜索有四条有文档支撑的后果,但没有一条是排名。二级域名是一个新的主机名,而 Google 的抓取、robots.txt、Search Console 资源、sitemap 四样东西的边界全都划在主机名上;子目录则原样继承所在站点的这四样。四条分叉里没有一条是你想要的,就用子目录。

读这篇前你要有什么

先想清楚这个板块给谁看、谁来维护,另外还要有一套「主机名定了之后地址怎么写」的规矩,那部分在 seo url 怎么起。这一篇只管第一个斜杠之前的那段。

subdomain vs subfolder 到底差在哪

blog.example.comexample.com/blog/ 给读者看的是同样的内容,差别在于前者是一个新主机,而主机正是几乎所有抓取规则的作用单位。Google 在讲抓取预算时把自己的定义写死了:「In this context, Google's crawling infrastructure defines a site as a unique hostname. For example, https://www.example.com/ and https://code.example.com/ are treated as separate sites and have separate crawl budgets」(大型网站的抓取预算管理,2026-09-04 访问)。

子目录是继承,二级域名是从头开始。

二级域名会让哪四样东西分叉

每一行都是有文档的行为,不是关于权重的看法。每一行同时也是你要为第二个主机再做一遍的活。

分叉的子目录二级域名
robots.txt一份就管住了要有自己的一份
抓取预算和主站共用另算一份
Search Console在同一个资源里另建,或用域名级资源
sitemap同一份、同一主机另一份,或做跨站提交

最容易被忽略的是第一行,因为这条规则是绝对的:「A robots.txt on a subdomain is only valid for that subdomain」,更一般的那句是「The rules listed in the robots.txt file apply only to the host, protocol, and port number where the robots.txt file is hosted」(robots.txt 介绍与指南,2026-09-04 访问)。你在主域名根目录上精心写好的那份,对上周才上线的二级域名一条都不管。那个二级域名要么自己发一份,要么一份都没有。

sitemap 那一行最安静。sitemap 是按它被放在哪儿来核对的,所以挂在主域名根目录、里面却列着二级域名网址的那份,不会自动被认。官方文档写明跨站提交是支持的做法,但跨站提交是要人去配的,不会因为两个主机名都归你就自动成立。

还有一句得说清楚:这四行都不是「权重会不会流过去」。它们是管道层面的事 —— 哪份文件管哪一块、哪份配额算在哪儿、哪个后台看得到结果。中文圈讨论这个话题时最常见的形式是「权重会不会被分走」,而能引用到官方原文的只有上面这四条。

出海站的实际处境:托管平台常常替你做了决定

这一节是给出海独立站的。中文团队遇到的多数不是「哪个更好」,而是「平台只给我一条路」:主站在托管电商平台上,博客想用另一套系统,而多数托管平台不让你在主域名的路径下挂进另一个系统 —— 平台层面改不动的那几类东西写在 托管平台改不动的那几件事。这时二级域名不是选择,是唯一可行的做法。

场景选哪个为什么
营销站的博客子目录同一批读者,同一个团队
某个产品的文档子目录读者是从产品页过来的
第三方托管的工具二级域名你根本放不进路径里
状态页、登录入口二级域名本来就不该被抓
用户自建的子站二级域名隔离本身就是目的
某个语种或国家都行官方把两种都列为可行

最后一行不是和稀泥。讲国际化时,Google 把国别域名、二级域名、子目录三种并排给利弊而不给推荐,给子目录写的好处是「Easy to set up」和「Low maintenance (same host)」(多地区与多语言网站的管理,2026-09-04 访问)。它给二级域名写的那条「隔离」,对一个人的团队来说是成本,不是好处。

还有一种做法在中文圈很常见:用反向代理把二级域名的内容映射到主域名的一个路径下。技术上可行,代价是你从此多了一层要维护的东西 —— 缓存、跳转、两边内容同时可访问导致的重复地址。它到底值不值,取决于你有没有人长期看着这一层,这件事我们没有做过前后对照的测量,不给结论。

五个问题定下来

按顺序答,答到第一个「是」就停。

  1. 这些内容技术上能不能放进现有主机的一个路径里。放不进去 —— 第三方工单系统、供应商的应用 —— 决定已经替你做完了。
  2. 它需不需要被抓取。登录页、状态页不需要,单独放一个主机能让排除它变成一行配置。
  3. 会不会由另一个团队按另一套节奏发布。两个主机就是两条不共用构建的发布线,这是实打实的收益。
  4. 第二份 robots.txt、第二份 sitemap、第二个资源,有没有人认领。没人认领,这个二级域名就会悄悄进入无人管理的状态。
  5. 以上都不是。那就用子目录。

手上已有的先自查一遍

拿一个你已经在运营的站跑一遍。第三条命令找的是没人会去看的那个错。

# 二级域名有没有自己的 robots.txt,和主站那份是不是两份
curl -s https://example.com/robots.txt      | head -20
curl -s https://blog.example.com/robots.txt | head -20

# 你的 sitemap 里到底列着几个主机名
curl -s https://example.com/sitemap.xml \
  | grep -oE '<loc>https?://[^/]+' | sed 's|<loc>||' | sort | uniq -c

# DNS 上它是不是一个独立主机
dig +short blog.example.com

sitemap 里出现两个主机名不自动等于错 —— 跨站提交是官方支持的。它错在没有人是有意这么配的,而多数情况正是这样。

三种会出事的做法

三种的根都一样:把第二个主机当成第一个主机在用。

  1. 二级域名没有自己的 robots.txt。你在主域名上写的那份对它一条都不管。用上面第一条命令查,别凭印象。
  2. 第二个资源根本没人验证。主域名上的 URL-prefix 资源不会报二级域名的任何数据,于是那个板块看起来一次曝光都没有,其实只是没人给它建资源。这一步在 search console verification 五种方法怎么选
  3. 搬家只做了跳转。example.com/blog/ 搬到 blog.example.com,等于一次性换掉每一条网址的主机。跳转是简单的那一半;站内链接、canonical 标签、sitemap 会一直指着老主机,直到有人去改。

这一篇答不了的是:两种到底哪个排名更好。官方文档没有任何一句写过排名差别,我们也没有做过能隔离变量的测试;而任何一个搬完之后变好的站,同一时期都还改了十几样别的东西。上面四条分叉是有文档的,排名那句没有。想先看看两个主机各自返回了什么,可以 看看 QueryWin 是怎么读一个页面的

常见问题

二级域名会被 Google 当成另一个站吗

就抓取而言是的,官方就是这么写的。但那句话说的是主机名和抓取配额,不是页面怎么被评分。

二级域名会不会分走权重

没有官方文档这么说,我们也拿不出测量。能确定的是它会让你多出四样要单独维护的东西,对小团队来说,这四样本身就是全部理由。

已经在用二级域名,要不要搬进子目录

只有在你能说出一个具体问题时才搬。换主机会动到你所有的网址,为一个没人量过的收益去做,是用一次猜测买下一大堆风险。

多语言站该用哪种

Google 把两种都列为可行,给的是利弊不是推荐。子目录维护成本低;二级域名的好处是可以交给另一个团队、另一台服务器。

www 算不算二级域名

技术上算,所以 example.comwww.example.com 是两个主机,robots.txt 的作用范围也是两套。只服务其中一个,另一个做跳转,并且确认 Search Console 资源对的是你真正在服务的那个。

本文属于 QueryWin 实操手册 · 第 2 阶

subdomain vs subfolder 怎么选:二级域名一挂上去,四样东西当场分家