当页面数量、栏目层级和更新频率同时上升,手工逐页处理会从“可控”变成“不可靠”。更适合继续手工的是判断类工作,例如确定页面意图、决定合并或拆分、处理争议性 canonical;更适合转为规则化批量处理的是重复且可验证的执行类工作,例如批量检查标题模板、内链缺口、状态码异常和结构化数据缺失。下面按“先给有条件结论、再给失效反例、最后给下一步动作”的顺序展开。
结论成立的条件是:同类页面达到几十上百个,且改动逻辑可以用同一套判断标准描述。此时以下工作不适合继续手工做。
这些工作的共同点是:判断标准可以事先写清楚,结果可以复核,且重复次数远高于判断次数。
如果网站规模扩大主要来自少量高价值页面,而不是大量同构页面,那么“批量处理”反而可能有害。假设一个站点只有二十个页面,但每个页面都对应不同业务线、不同转化路径和不同法律表述,此时把标题、内链和结构化数据全部模板化,会抹掉页面之间的关键差异。更合理的做法是:只把状态码监控、链接检查这类纯执行工作自动化,标题、内链和内容结构仍逐页判断。
换句话说,是否适合手工做,不取决于“页面总数”这一个数字,而取决于同类页面是否共享同一套判断规则。如果每页都要单独决策,手工反而更安全;如果规则一致,手工就会成为错误来源。
要判断一项工作是否该从手工转为规则化,可以观察以下证据:
需要提醒的是,抓取量下降、索引量归零或某个统计指标变差,不能单独证明“手工做错了”。它也可能是服务器波动、robots 规则调整、内容质量变化或外部链接丢失导致。应把指标变化与具体操作时间、模板改动和日志记录对照,再决定下一步。
实际可执行的动作是:选一个当前最痛的重复工作,例如标题检查或内链补缺,先手工处理二十个同类页面,记录判断依据和操作结果。如果其中超过八成页面可以用同一套规则描述,就把这项工作转为模板或脚本处理,并保留人工复核入口;如果规则覆盖率低,就继续手工,只把状态码、链接检查这类纯执行项自动化。
这个动作的结果会直接影响下一步:规则覆盖率高,说明问题在流程和模板,应优先修模板;规则覆盖率低,说明问题在页面意图和内容差异,应优先补判断标准,而不是继续增加手工操作量。规模扩大后,真正危险的不是手工本身,而是把需要判断的工作误当成重复劳动,或者把重复劳动误当成需要逐页判断。