结论先给:如果同一事实在两篇文章里承担的任务不同——一篇用它做判断依据,另一篇用它做操作前提——保留两处并各自写透,比强行删成一句更有效;如果它只是背景复述、读完不改变读者下一步动作,就合并到一篇,另一篇只留一句指向性交代。判断标准不是“重复了几次”,而是“删掉后读者还能不能完成这篇的任务”。
把重复内容当成一个整体来删,往往删错地方。更稳的做法是先分类:
只有第一类适合大段合并;第二、三类重复出现,通常是结构需要,不是内容失控。
面对同一批事实,常见两种取舍。
成立条件:这些事实是背景知识,读者不需要在同一页内用它做判断。代价是每篇都要多一次跳转,如果指向的那篇本身没写透,读者会在两页之间来回找。
成立条件:事实是这篇论证链条上的一环,删掉会让结论悬空。代价是维护成本上升——同一事实若日后需要修正,改动点变多,容易改漏。
假设一个场景:两篇文章都在讲页面分工,一篇要回答“要不要拆”,另一篇要回答“拆完怎么排优先级”。同一句关于“一个页面只承接一类意图”的表述,在前者里是判断依据,在后者里是操作前提。此时保留两处、各自展开,读者体验更好;若强行合并,后者会缺一个前提。这只是用于说明比较方法的假设,不是真实项目结论。
如果两篇文章的读者路径高度重叠——比如都从同一个入口进入、都服务于同一类查询意图——那么“各自保留”就会变成读者连续读到两遍同样的段落,此时合并反而更合适。判断信号不是重复字数,而是:读者是否会在一次阅读中同时遇到这两处。会,就合并;不会,就按任务保留。
另一个失效情形是事实本身仍在变动。若某条事实尚未稳定,把它复制到多篇会让后续修正范围不可控,这时应先集中到一处,等稳定后再决定是否分发。
具体可以这样做:把重复出现的句子逐条标上它服务的是“定义、证据还是操作”,再标上“读者会不会在同一轮阅读中连续遇到”。两类标注做完,合并与保留的边界基本就清楚了。
改完之后,不要只看请求量或抓取量的变化就下结论——这类数字归零或上升,也可能是抓取节奏、入口调整、季节波动造成的,不能单独证明删减或保留做对了。更有意义的验证是:读者在目标页内是否还需要跳出去才能完成下一步。如果不需要了,说明这次取舍站得住;如果还需要,就回到标注那一步重新分。