结论先说:旧文章合并后,来源链接不能按“新页面统一继承旧链接”处理,而要按来源页与旧目标页的对应关系重新分配。个别样本里,把两个旧页面合并成一个新页面后,原来源链接仍保留并指向新页面,看起来一切正常;但规模一放大,就会出现部分来源页仍指向已不存在的旧地址、部分来源页指向新页面却与上下文不匹配、还有部分来源页在合并中被一起删掉。此时真正要做的不是补一条新链接,而是判断每条来源链接的原始意图是否还能在新页面上成立。
假设有 10 个来源页分别链接到旧页面 A 和旧页面 B,合并后得到新页面 C。小样本里,如果 A、B 主题接近,来源页的锚文本也接近,那么把链接统一改到 C,看起来没有明显问题。读者点进去仍能看到相关内容,来源页的上下文也没有断裂。
但同样的做法放大到几百个来源页时,例外会集中出现。原因不在于“合并”这个动作本身,而在于来源页当初链接 A 或 B 的理由并不相同。有些来源页引用的是 A 里的操作步骤,有些引用的是 B 里的定义,还有些只是在文末顺带列出 A、B 两个地址。合并后,C 可能同时包含这些内容,但来源页的锚文本和周边句子只对应其中一部分。
这里有一个可区分的原因:来源链接失效,不等于合并策略错误。它也可能只是来源页本身被改版、被删除,或者来源页早已不再维护。把这两类原因混在一起,就会误判成“合并后必须把所有链接重写一遍”。
解释一:继承关系没有建立。旧页面 A、B 被合并成 C 后,如果旧地址没有保留可识别的跳转关系,来源页仍指向 A 或 B,就会出现指向空地址的情况。这种失效与合并直接相关,表现是失效链接集中出现在原来链接 A、B 的来源页上。
解释二:来源页自身发生变动。来源页可能因为改版、栏目调整或人工清理,把原来的链接删掉或替换。这种失效与合并无关,表现是失效链接分散在不同目标页上,不只集中在被合并的旧地址上。
能区分这两种解释的证据,不是链接总数有没有下降,而是看失效链接的目标分布和来源页的修改时间。如果失效目标几乎都是 A、B,且来源页没有近期改动记录,那么更可能是继承关系没建立。如果失效目标分散,且来源页有近期改版痕迹,那么更可能是来源页自身变化。请求量或抓取量归零不能单独证明合并处理正确,它还可能来自来源页被降权、被屏蔽或暂时不可访问。
面对一批来源链接,不要直接批量替换。先按来源页与旧目标页的关系分成三类:
这个分类的实际作用是决定下一步动作。内容对应型需要逐条看上下文,地址列举型可以按规则归并,历史存档型则优先保持可访问。把三类混在一起批量处理,最容易出现的问题是把已经失去上下文支撑的链接硬改到新页面,读者点进去后找不到来源页所说的内容。
假设旧页面 A 讲“来源页筛选方法”,旧页面 B 讲“来源页记录格式”,合并后得到 C“来源页筛选与记录”。某来源页在正文中写“筛选方法见 A”,锚文本是“筛选方法”。合并后,C 里仍保留筛选方法一节,那么把该链接改到 C 是成立的。另一个来源页在正文中写“记录格式参考 B”,锚文本是“记录格式”,C 里也保留了记录格式一节,同样可以改到 C。
但如果第三个来源页写“我按 A 的步骤做完后,发现 B 的格式不适用”,它同时引用了 A 和 B,且带有比较关系。合并后如果只把两个链接都改到 C,读者会失去“A 与 B 原本是两个不同对象”的信息。此时更合适的做法是保留旧地址跳转,或在来源页中补充一句说明合并关系,而不是简单替换。
这个例子的边界在于:它假设来源页可以编辑,且旧地址可以保留跳转。如果来源页不受你控制,或者旧地址已经无法恢复,那么你能做的只是记录现状,并决定是否在新页面 C 上补充说明,而不是继续追着来源页改链接。
可执行的动作是:为每个被合并的旧地址建立一行对应关系,记录旧地址、新地址、来源页、锚文本、来源页上下文类型、旧地址是否可跳转。完成这张表后,你会得到两个直接结果。
第一,如果大部分来源链接属于内容对应型,且 C 保留了对应内容,那么可以按表逐条改到 C,并保留旧地址跳转作为兜底。第二,如果大量来源链接属于历史存档型,或者来源页上下文已经无法对应 C 的任何一节,那么就不应继续改链接,而应把重点放在旧地址可访问性和新页面 C 的说明上。
这张表还会影响下一步:当来源页不可编辑时,你能做的是确认旧地址是否还能到达 C,以及 C 是否清楚说明自己合并了哪些旧内容。把这两件事做完,比追求把所有来源链接都改成同一个新地址更接近实际可维护的状态。链接数量或第三方权重不能当作官方排名保证,重新分配来源链接的目标也不是堆高某个数字,而是让来源页的读者仍能找到它当初引用的内容。