结论是有条件的:当页面数量、模板类型和更新频率超过一个人能稳定核对的范围时,逐页手工处理内链、标题和索引状态会从“精细”变成“不可复现”,但若站点只有几十个页面且改动很少,手工仍然更可靠。判断依据不是页面总数本身,而是同一类改动是否需要在多个页面重复执行、执行结果能否被批量验证。
小站阶段,手工改十个页面的标题、补几个内链,很容易记住改过什么。规模扩大后,问题不在单次操作变慢,而在于遗漏没有明显信号。你手工处理了八十个页面,剩下二十个可能因为模板不同、URL 带参数或不在同一目录而没有被看到。此时抓取量没有下降,索引量也可能暂时稳定,于是容易误判为“已经处理完”。
要区分是遗漏还是正常波动,可以抽一组页面做核对:同一模板、同一层级、同一更新时间的页面,手工改动后是否都具备相同特征。如果同组页面里有一部分标题结构不同、内链入口不同,说明问题更可能是覆盖不完整,而不是搜索引擎暂时没更新。
下面这些工作并非绝对不能用人工,而是当同类页面重复出现时,手工的核对成本会超过改动本身。
一个实际动作是:先选一个模板类型,例如文章详情页,导出该类型下所有 URL 和标题,按标题重复次数排序。如果重复集中在少数模板,下一步应先修模板输出规则;如果重复分散且没有规律,才需要逐页处理。这个动作的结果会直接决定后续是写规则还是继续人工核对。
反例是:站点页面不多,但每一页都承担不同的转化任务,标题、内链和入口位置需要单独判断。此时批量规则可能把本来有差异的页面改成同一模式,反而削弱页面之间的区分度。手工处理的价值在于判断“这一页为什么需要这个链接”,而不是执行“所有页面都加这个链接”。
因此,是否放弃手工不取决于“大站”这个标签,而取决于三个条件是否同时成立:同类页面数量足够多、改动规则可以事先描述、改动结果可以用同一组字段验证。缺少任何一条,手工或半手工仍然是合理选择。
假设一个站点有一千个详情页,其中三百个由同一模板生成。你手工改了其中五十个页面的标题,发现这五十个页面的点击和展示没有明显变化,而另外两百五十个未改页面的数据也差不多。这个对比不能证明手工无效,因为样本选择、时间窗口和页面主题都可能不同。更可核对的证据是:这五十个页面是否都按同一规则修改、修改后标题是否不再重复、同模板的未改页面是否仍保留旧规则。如果规则一致但结果分散,下一步应检查模板和索引状态,而不是继续扩大手工范围。
另一个动作是建立一张最小核对表:页面类型、URL 规则、标题来源、内链来源、索引状态、最近一次改动时间。每次批量改动后,用这张表抽检同组页面。抽检结果如果显示同组页面仍不一致,说明规则没有覆盖完整;如果同组页面一致但个别页面异常,才回到单页排查。这样做的结果是把“感觉改了很多”变成“知道哪一类还没覆盖”。
网站规模扩大后,不适合继续手工做的是那些需要重复执行、且结果必须保持一致的规则型工作,例如模板标题输出、批量内链入口和索引状态分组核对。手工更适合判断单页意图、处理例外和确认规则是否合理。下一步不是立刻全面自动化,而是先选一个页面类型,导出同组页面并核对三个字段:标题是否唯一、内链入口是否一致、索引状态是否可解释。若同组页面在这三项上仍有明显分歧,优先修规则;若分歧只出现在少数页面,再保留手工处理。