当旧地址没有一一对应的新页面时,默认答案不是全部重定向到首页。更稳妥的做法是先给旧地址分类,再分别选择保留、改写或退出:能对应到主题近似的新页面就做定向跳转,确实没有承接页的旧地址就让它返回404或410并保留一段观察期,仍有独立价值的旧地址则保留并改写内容。判断依据是旧地址承担的流量与链接角色,而不是迁移工具能不能批量生成规则。
迁移中最容易被忽略的事实是,旧地址不只有“被访问”这一种角色。它可能同时承担外部链接落点、站内导航入口、用户书签入口和搜索结果的展示对象。这几种角色对处理方式的要求并不相同。
可以用一组可核对的证据来分类:
如果四项中至少两项成立,说明旧地址还有承接价值,优先考虑保留或改写;如果四项都不成立,只是历史遗留的空壳地址,退出的成本更低。
当旧地址对应的主题在新站里没有等价页面,且该主题本身仍值得存在时,保留是合理选择。保留不等于原样放着,通常需要把旧内容并入新站的导航与内链结构,并检查它是否与某个新页面形成重复或冲突。保留的代价是要长期维护两个内容体系,如果旧内容只是过渡产物,这个代价会持续累积。
改写适用于旧地址的主题仍然成立、只是结构或信息已经过时的场景。此时可以把旧地址当作承接页,更新内容并把它链接到新站的相关页面。改写与保留的差别在于,改写会改变页面本身,需要确认改动后仍能满足原有查询意图,否则可能丢掉旧地址原本承接的那部分访问。
退出的前提是确认旧地址既无外部链接落点,也无搜索展示记录,且站内没有指向它的链接。这种情况下让旧地址返回404或410,比强行跳转到不相关页面更符合事实。需要说明的是,robots.txt 的抓取限制不等于可靠的索引移除,它只是阻止抓取,不负责让已收录地址从结果中消失;站点地图不保证收录,把旧地址从站点地图移除也不会自动完成清理。
迁移时常见两种做法:把旧地址逐条映射到主题最接近的新页面,或者把无法映射的旧地址统一跳转到首页或栏目页。两者的适用条件不同。
逐条映射适用于旧地址数量可控、且能人工判断对应关系的场景。它的结果是用户和抓取都落到相关页面,后续观察时也更容易判断某个旧地址的流量是否被正确承接。批量跳转到首页适用于旧地址数量极大、且绝大多数确实没有对应内容的场景,但它会让所有无法映射的地址指向同一个不相关页面,用户找不到原内容,后续也很难从数据上区分哪些旧地址本来有价值。
一个可操作的折中是:先对旧地址做一轮分类,把有链接或有展示记录的地址挑出来逐条映射,其余地址再考虑统一处理。这个动作的结果会直接影响下一步——如果分类后发现大量地址其实有外部链接,说明批量跳转的损失比预想大,应回到逐条映射。
假设某站迁移后,旧地址 /old-guide-a 对应的新站没有同主题页面,但该地址有一条来自外部站点的链接,且近一段时间仍有搜索展示。此时合理顺序是:先保留该地址并更新内容,把它接入新站内链;观察一段时间后再决定是否改写为新的主题方向。相反,如果另一个旧地址 /old-tag-x 既无外部链接,也无站内链接和展示记录,直接让它返回404即可,不必为它专门造一个跳转目标。
这个例子的数字和条件都是假设,用于说明比较方法:判断依据是链接与展示这两类可核对事实,而不是迁移工具是否报错。
多个角色对同一批旧地址的处理意见不一致时,分歧通常来自各自看到的事实不同:运营看到的是入口流量,开发看到的是规则数量,内容方看到的是主题归属。把分歧转成项目的方式是列出每个旧地址的四项事实——外部链接、搜索展示、站内链接、内容独立价值——然后按上面三类的适用前提逐条归类。
归类完成后,先执行影响面最大的一类,再观察旧地址的访问与展示变化。需要提醒的是,请求量、抓取量或某项统计归零不能单独证明处理正确,它也可能是迁移后整体流量结构变化、统计口径调整或观察窗口太短造成的。因此下一步不是立刻扩大处理范围,而是先确认这些现象还有哪些合理解释,再决定是否调整保留、改写与退出的比例。