规模扩大后最先暴露的问题,往往不是排名掉了,而是你手工维护的那份清单开始失真:页面在增加,清单没变,于是“已处理”的判断越来越不可靠。是否该停止手工,取决于这项工作是否依赖逐页人工判断,以及它的错误是否会向下游传播。
规模扩大后常见一种反常结果:团队觉得手工更可控,因为每一页都有人看过。但与此同时,遗漏开始集中在两类地方——新生成的页面,以及被模板改动波及的旧页面。手工并没有变差,是它覆盖的对象变了。
这背后有两种解释。第一种是流程问题:任务仍按“页”分配,没有按“模板或规则”分配,所以增长只增加了工作量,没有增加覆盖方式。第二种是判断问题:团队把手工核对当成质量保证,但它实际只证明了被抽到的页面没问题,不能证明整批页面没问题。这两种解释对应完全不同的动作,先分清再决定停不停。
可以用一个简单标准筛选:这项工作是否能用“同一类页面应当满足同一条件”来描述。能描述的,适合转成规则或批量检查;不能描述的,才值得保留人工。
反过来,涉及意图判断、页面取舍、内容是否值得保留的工作,不适合完全交给规则。规则可以给出候选,决定仍要人做。
假设一个站点从 200 页扩到 2000 页,团队仍按老办法每周手工看 50 页。表面覆盖了四分之一,但新增页面集中在最近两周,抽样很可能避开它们。若改成按模板输出“标题重复页”“无内链入口页”“状态异常页”三份清单,结果不是立刻变好,而是问题从“感觉没问题”变成“有具体数量的待处理项”。
这个动作的结果会直接影响下一步:如果清单里大量是同一模板造成的,应先改模板再清页面;如果清单里是零散的历史页面,才适合逐条处理。先改模板还是先清页面,取决于问题是否成簇出现,这与页面总数无关。
要判断问题出在流程还是判断,可以看三组可核对的证据:
需要提醒的是,抓取量下降、某类页面数量归零,都不能单独证明处理正确。抓取量可能受访问频率、服务器响应或站点结构调整影响;页面数量归零也可能是统计口径变了。把这些现象当作线索,而不是结论。
规模扩大不等于全部自动化。至少要保留三类人工判断:新模板上线前的规则确认、批量清单的优先级排序、以及规则无法覆盖的例外页面。规则负责发现,人负责决定哪些值得改、按什么顺序改。
一个可执行的动作是:先选一个模板,把该模板下所有页面的标题、内链入口、状态码各跑一遍,得到三份清单。如果清单显示问题集中在模板本身,就先改模板,再重新跑同一批页面,观察问题数量是否下降。这个前后对比,比继续增加手工抽查更能说明规模扩大后该把力气放在哪里。