结论是有条件的:如果多篇文章里的相同事实服务于同一个决策,应当合并到一篇主文,其余页面只保留指向它的必要摘要;如果相同事实分别服务于不同搜索意图,且读者在各自场景下需要独立完成判断,则保留拆开写,但必须让每篇的事实承担不同功能,而不是换词复述。判断依据不是字数或关键词密度,而是读者读完这一篇后能否直接行动。
当几篇长尾页都在回答“要不要做某件事”“选A还是选B”时,重复的事实通常只是背景铺垫。此时把事实集中到一篇,其他页面用一句话交代前提并链接过去,能减少读者反复阅读相同段落。一个实际动作是:列出每篇中重复出现的事实句,标注它支撑的决策。如果三篇里同一组事实都指向“先判断适用条件”,就合并到条件最完整的那篇。
这样做的结果是,后续更新只需改一处,其他页面的摘要不会与主文冲突。下一步应检查被合并页面是否还有独立的长尾问法,若有,保留该问法作为小标题,而不是另起一篇。
相同事实在不同对象上可能产生不同取舍。例如“处理时间取决于数据量”这句话,在批量任务和单次查询两个场景下,读者需要的下一步动作完全不同。批量任务读者要判断是否分批,单次查询读者要判断是否等待。此时拆开写更合理,但每篇必须把该事实落到本场景的具体动作上,不能只改主语。
可区分原因的证据是:把两篇的结论句对调,如果读者仍能照做,说明两篇没有独立价值,应合并;如果对调后读者会做出错误动作,说明拆开成立。这个测试不需要真实流量数据,只需检查动作是否随场景改变。
假设你有一组长尾页面,重复事实是“该功能需要先完成配置”。如果这些页面分别面向不同入口、不同权限的读者,合并成一篇会让部分读者找不到与自己权限对应的步骤。此时拆开写不是冗余,而是必要分叉。反过来说,如果不同入口只是名称不同、配置步骤完全一致,那么拆开写就是冗余,应合并并保留入口名称作为小标题。
这个反例说明:判断依据是读者动作是否分叉,而不是页面数量或关键词覆盖数量。请求量或抓取量下降不能单独证明合并正确,也可能只是入口链接减少或页面被替换后的正常波动。
假设你有三篇长尾页都提到“先检查数据范围”,但一篇的下一步是缩小范围重跑,另一篇是切换范围类型,第三篇只是重复检查。前两篇应保留并改写条件,第三篇应合并。这个比较方法只用于判断动作是否分叉,不代表任何固定字数或密度标准。
先处理重复事实最集中的一组页面,合并或改写后观察读者是否还需要跳转才能完成动作。如果需要,说明拆开成立;如果不需要,说明合并成立。代价是合并会减少独立页面数量,可能影响那些依赖多入口到达的读者;拆开则增加维护点,后续修改容易遗漏。选择时应接受其中一种代价,而不是同时追求页面数量和内容唯一性。