先给结论:合并前不要直接删掉较弱的那一篇,而是把两页的内容按“事实、例子、操作步骤、限定条件”四类拆开,逐条比对,把只出现在其中一页的信息挪到保留页的对应位置,再处理重复表述。缺少完整流量数据或后台权限时,这个比对仍然可以做,只是判断依据从数据变成内容本身。
假设你的博客里有两篇页面,一篇叫“博客文章怎么写”,另一篇叫“写博客文章的步骤”。两篇都在讲选题、列提纲、写初稿、修改,核心结论相近。第一篇里有一段讲“采访式选题”的具体做法,第二篇里有一张检查清单和一段关于“先写结论再补论据”的说明。你打算把第二篇合并进第一篇,因为第一篇的标题更贴近搜索意图。
此时不能只看哪篇更长或哪篇更早发布。要先确认哪些信息是独有且对读者有用的,再决定合并后的页面长什么样。
把两页正文分别复制到同一个文档里,逐段打标签。标签只有四类:
打完标签后,把两页中标签相同且表述相近的段落放在一起。只出现在其中一页的段落,就是需要保留的独有信息。这个动作不需要后台数据,只需要一个文档和耐心。
独有信息不是全部保留,而是按下面的顺序判断:
假设第二篇里的检查清单有八项,其中三项在第一篇里没有出现。可以把这三项补进第一篇的修改环节,而不是把八项清单整段搬过去。这样既保留了独有信息,也不让合并后的页面变成两篇的拼接。
如果你没有完整的搜索词报告、点击数据或页面停留数据,仍然可以执行最小动作:完成四类标签比对,标出独有信息,写出合并后的提纲。这个动作的结果是得到一份可执行的合并方案,而不是证明合并一定会带来流量变化。
合并上线后,如果某一页的抓取量或展示量下降,不能单独推出“合并正确”或“合并错误”。季节变化、搜索需求波动、采集时间不同、页面被重新抓取的时间差,都可能解释这个现象。更稳妥的做法是记录合并前后的页面标题、正文结构和内部链接变化,等一段时间后再看整体趋势,而不是盯着单日数字下结论。
合并完成后,打开保留页,逐段问自己:这段话里的信息,在另一页里有没有对应的独有内容?如果有,是否已经以某种形式出现?如果答案是否定的,就回到比对文档,确认是遗漏还是有意舍弃。这个动作的结果会直接影响下一步:如果发现遗漏的是限定条件或操作步骤,就补回去;如果发现舍弃的是重复例子,就保持现状。
最后,把被合并页面的旧地址指向保留页,并确认保留页的标题和开头段落能覆盖两页原本回答的问题。缺少数据时,这一步仍然可以做,只是判断依据来自内容覆盖度,而不是流量预测。