当页面从几十个涨到几百上千个,最先崩掉的通常不是策略,而是手工维护的一致性。判断标准很直接:一项工作如果每次执行都要靠人记住规则、重复核对同一批字段,并且漏做一次就会影响整站结构或索引,它就不适合继续手工做。反过来,页面量小、规则还在试错阶段时,手工反而是最快的方式。下面按“样本期”和“规模化期”两种条件分别说明该换什么、怎么换、哪些例外要保留人工。
样本期(比如几十个页面)手工做内链、改标题、提交页面,问题不大,因为你能同时看到全貌。规模化后,同样的动作会分化成两类结果。
区分依据是:规则能否被写成明确的输入输出。能写清楚的,交给模板或脚本;写不清楚的,留给人,但要限定检查范围。
当同一类页面的标题格式、描述格式、内链位置已经验证过两三批页面且没有明显反例,就可以固化。实际动作是:先抽 20 到 30 个页面,把它们的标题、描述、H1、canonical 导出成一份对照表,确认字段来源一致;再把这套规则写进模板或批量处理脚本,重新生成后随机抽 10 个页面与旧版逐项比对。
这个动作的结果会直接决定下一步:如果抽样比对全部一致,说明规则可以覆盖全站,后续新增页面走同一模板即可;如果出现不一致,说明规则里还藏着没写明的例外(比如某类页面需要单独的描述逻辑),此时应该先补规则,而不是继续扩大手工修改的范围。手工改得越多,例外越难被发现。
如果某类页面的标题或结构还没有稳定结论,全量批量改是危险的,因为一旦方向错了,回滚成本很高。这时合理的做法是手工维护一个小样本集,比如按栏目各取若干页面,记录改动前后的抓取与索引状态,等结论稳定再考虑批量。
需要说明的是,抓取量、索引量或某个统计归零,并不能单独证明处理正确。它可能来自抓取预算变化、站点结构调整、外部链接变动,也可能只是统计口径或时间窗口的问题。所以样本期的判断要结合多批数据,而不是看单次波动就下结论。
例外情况是:页面数量仍然很少、规则还在频繁调整、或者某类页面只有个位数,此时手工更快也更可控,不必为了“自动化”提前引入复杂流程。
假设一个站点从 50 个页面扩到 800 个页面,其中 600 个是同一模板生成的产品页,200 个是编辑手工写的文章。可以这样切:产品页的标题、描述、canonical、基础内链全部由模板输出,人工只抽查;文章页保留人工写标题和描述,但用一份字段清单做发布前检查。这样做的结果是,人工时间集中在真正需要判断的文章上,产品页的一致性由规则保证。若后续发现某类产品页需要单独的标题逻辑,再把它拆成独立模板,而不是回到逐页修改。
这个例子里的数字只是用来说明切分方法,不代表任何实际站点的规模或效果。真正要记住的是:规模扩大后,手工应该收缩到判断类工作和抽样验证上,重复的一致性工作交给模板或脚本,并在规则稳定之前不要急着全量铺开。