结论有前提:当页面数量、模板类型和变更频率同时上升,且同一件事需要多人重复核对时,手工做就不再是“仔细”,而是不可验证。反例也存在:如果站点只有几十个页面、模板单一、更新很少,手工检查反而更快、更不容易误伤,此时强行上批量流程只会增加维护成本。
判断一项工作是否该继续手工做,不看它是否重要,而看它是否满足这三个条件:数量小、判断依赖上下文、出错后能立刻发现并回退。三者同时成立,手工就是合理选择。
一旦其中一条不成立,手工就从“精细”变成“不可复现”。
不适合继续手工做的,不是所有工作,而是那些规则明确、重复发生、结果需要逐条比对的核对类任务。典型有三类。
这三类的共同点是:判断规则可以事先写清楚,结果可以逐条核对。把它们交给脚本或批量工具,人只负责看差异,而不是负责找差异。
假设站点从200个页面扩到5000个页面,模板从3种变成12种。原来的做法是每周手工打开十几个页面看标题和canonical。现在可以改成:抓取全部URL,导出标题、canonical、状态码三列,与模板规则表逐条比对。
动作的结果会直接决定下一步:如果差异集中在少数几个模板,说明是模板层的问题,改模板即可;如果差异分散、无规律,说明问题出在内容录入或发布流程,改模板没用,要回头查流程。这一步的意义不是“发现了多少错误”,而是把问题定位到模板层还是流程层。定位错了,后续所有修补都会反复。
需要说明:抓取量下降或某项统计归零,本身不能证明处理正确。它也可能是抓取预算变化、服务器临时响应异常、或工具口径调整。要结合状态码、响应时间和实际可访问性一起看,不能只凭一个数字下结论。
反过来,以下工作即使规模扩大,也常常更适合人工判断,或者至少需要人工先定义规则:
判断标准很简单:如果一件事的“正确答案”还需要讨论,就先别自动化;如果答案已经明确、只是重复劳动,就该交出去。
多个角色对同一件事理解不同时,争论往往没有落点。更有效的做法是把它转成一份可核对的清单:列出需要检查的字段、判定规则、以及谁负责确认差异。比如“标题是否重复”这件事,先定义什么叫重复(完全一致还是高度相似),再决定用什么方式比对,最后指定由谁看结果。
这样做的结果不是立刻消除分歧,而是让分歧变成可验证的条目:规则写清楚了,谁对谁错就能用数据说话,而不是靠职位或印象。下一步动作也随之明确——如果规则本身还有争议,就先对齐规则;如果规则已定,就直接进入比对和修复。
所以,规模扩大后真正不该继续手工做的,是那些规则已定、重复发生、需要逐条核对的活。把它们交出去,人才有余力处理规则本身还没定的部分。