结论有条件:只有当每个域名都有清晰、互不重叠的用途声明,并且旧域名的退出路径与保留范围同时确定时,多域名相似内容才不会长期拖累百度收录更新。反例是:如果各域名只是同一套内容的镜像,仅靠robots.txt限制抓取或提交站点地图,通常无法让百度稳定地区分主次,收录状态往往会继续波动。
“相似内容”不等于“重复内容”。百度需要判断的是:当用户搜索某个主题时,哪个域名应当作为该主题的归属页面。因此,说明用途不是写给人看的品牌介绍,而是让搜索引擎能推断出域名之间的分工。
可落地的做法是为每个域名写一份用途声明,至少包含三件事:该域名保留哪类内容、该域名不再新增哪类内容、该域名最终是退出还是长期保留。假设某公司旧站为 old.example.com,新站为 www.example.com,旧站保留产品历史文档,新站承载现行产品页。那么用途声明应明确:旧站不再发布现行产品页,新站不复制历史文档。这个声明会直接决定下一步是设置跳转、保留独立栏目,还是整体下线,而不是先动手改robots.txt。
旧内容、旧系统或旧合作关系退出时,常见选择不是“全留”或“全删”,而是按保留价值分档。不同分档对应不同动作,动作结果会影响百度收录更新的走向。
一个可区分的证据是:在百度搜索资源平台查看旧域名的抓取和索引状态时,如果退出URL仍被频繁抓取且返回200,说明退出动作没有真正生效;如果返回301且目标页面内容对应,旧URL的收录记录才可能逐步被替换。但要注意,抓取量归零不能单独证明处理正确,也可能是百度暂时降低了该域名的抓取优先级,或robots.txt屏蔽了抓取路径,这两种情况的含义完全不同。
很多团队在多个域名并存时,第一反应是给每个域名提交站点地图,再用robots.txt屏蔽旧域名。这个顺序容易造成误判。
站点地图的作用是告知百度有哪些URL可供发现,它不保证收录,也不表达“这个域名只用于历史存档”。如果旧域名站点地图里仍包含现行产品页,百度没有理由把它当成旧内容库。robots.txt的抓取限制同样不等于可靠的索引移除:被robots.txt禁止抓取的URL仍可能因为外部链接而出现在搜索结果中,只是百度无法获取页面内容来做进一步判断。
更稳妥的顺序是:先确定每个域名的用途和保留范围,再决定哪些URL需要301、哪些需要410、哪些继续保留。站点地图只提交继续保留的URL,robots.txt只用于阻止确实不需要被抓取的路径,而不是用来“清理收录”。这个顺序会影响下一步:如果先屏蔽再跳转,百度可能无法发现跳转关系,旧URL的替换周期会被拉长。
假设某团队有 docs.example.com 和 www.example.com 两个域名。旧合作关系结束后,旧站上的合作品牌页需要退出,但产品历史文档仍有用户查阅。此时可以这样处理:
执行后,下一步应观察旧域名中已退出URL的返回状态是否稳定为301或410,以及新域名对应页面是否被百度抓取并替换旧URL。如果旧URL仍以200返回,说明退出动作没有落地;如果新URL长期未被抓取,则需要检查新页面是否有独立入口和内部链接,而不是继续在旧域名上加内容。
如果多个域名承载的相似内容并非来自同一主体,或者旧域名的所有权、服务器控制权已经不在自己手里,那么用途声明就无法执行。此时能做的只是在新域名上建立清晰的内容归属,并接受旧域名可能继续出现在百度结果中。另一个失效条件是:业务上确实需要两个域名同时发布同一篇内容,且无法做任何主次区分。这种情况下,百度收录更新会长期处于不稳定状态,任何“先观察一段时间”的做法都不会自动解决归属问题。
因此,判断是否继续投入多域名整理工作的依据,不是百度是否已经更新收录,而是每个域名的退出路径和保留范围是否已经明确到可以逐条执行。