先不要直接删除其中一个页面。把两个页面各自独有的信息先抽出来,做成一份“信息清单”,再决定合并后的页面用哪些段落承接这些内容。这样做的原因是:两个页面看似答案相近,往往只在主结论上重合,细节、限定条件、示例和证据各自不同。直接重定向或删掉一个,丢失的常常正是这些独有部分。
把两个页面的正文按段落拆开,逐段标注它回答的是哪个子问题。常见的相近只发生在主结论层面,比如两个页面都在回答“某件事要不要做”,但一个页面给了适用条件,另一个页面给了操作顺序。判断依据可以看三点:
如果两个页面在某个子问题上完全重合,那部分可以只保留一份;只要出现上面任意一种差异,就要进入保留清单,而不是随页面一起消失。
建议用一张简单的对照表来操作,字段包括:子问题、页面A的说法、页面B的说法、差异类型、合并后由谁承接。差异类型可以粗分为“条件不同”“证据不同”“粒度不同”“结论冲突”四类。前两类通常可以直接合并进同一段;粒度不同时,保留更细的那一层;结论冲突时不要急着二选一,先确认两个结论是否对应不同前提。
举个假设例子:页面A说某操作适合新站,页面B说同一操作不适合新站。表面冲突,但若页面B的前提是“站点还没有稳定抓取”,那两者其实是在不同条件下成立。合并时写成“在抓取稳定的前提下适合,否则先解决抓取”,就把分歧转成了可核对的条件句,而不是丢掉一方。
实际操作顺序建议是:先把两个页面的独有信息全部搬进草稿,再重新组织标题层级。具体可以这样做:
这个动作的结果会直接影响下一步:如果合并后某个原子问题没有任何段落承接,说明这次合并会丢失覆盖,需要补回或保留独立页面;如果所有子问题都有承接,才进入重定向或删除的决策。
合并完成后,如果要观察效果,需要先记录合并前的基线,包括该主题下两个页面各自承接的查询类型、进入页和停留表现。比较时要注意,搜索需求本身会随季节和热点变化,数据采集口径也可能不同。某段时间内某个页面的请求量归零,不能单独证明合并正确,它也可能来自抓取延迟、展示位置变化或需求本身下降。更稳妥的做法是看同一组子问题是否仍有页面承接,而不是只看单个页面的量。
如果两个页面各自覆盖的子问题足够独立,且都有稳定的进入需求,那么保留两个页面、只做互相链接和差异化,往往比强行合并更安全。判断标准不是“答案像不像”,而是“用户带着哪个问题进来”。当两个页面分别对应不同前提下的同一问题,合并后用一个页面承接两种前提,通常可行;当它们对应的是两个不同决策,合并会让页面意图变模糊,这时应保留分列。
把独有信息先抽成清单,再决定合并还是保留,能让这次改动有据可查;即使后续发现某个子问题覆盖不足,也能回到清单定位是哪一条信息在合并中被漏掉了。