当旧站迁移到新站、而历史地址无法与新页面一一对应时,优先保留能确认语义的旧地址并做单点跳转,无法确认的地址不要批量指向首页,而是按可验证的最小动作先分区处理。这样做的直接结果是:能确认的流量继续落到相关页面,不能确认的地址进入可控的观察名单,而不是被一个全站跳转掩盖。
保留、改写、退出并不是三选一的固定顺序,而是取决于你手里有什么证据。保留适用于旧地址与新页面主题一致、且你能拿到旧地址清单的情况;改写适用于旧地址本身带有可推断的路径规律,例如栏目名或编号能对应新结构;退出适用于旧地址对应的内容已经彻底不存在,且没有可替代的同类页面。
如果缺少完整数据或权限,判断依据会变弱。此时不要假设“旧地址一定有价值”,也不要假设“全部跳首页最省事”。更稳妥的做法是把能拿到的部分先处理,把拿不到的部分标记为待确认,而不是用一个统一规则覆盖全部。
第一步是尽可能收集旧地址。可用的来源包括服务器访问日志、旧站地图文件、外部链接记录,以及旧站导航和栏目页里出现的链接。如果这些都不完整,至少把旧站主要栏目和曾经被外部引用的页面整理出来。
第二步是按路径前缀分组。例如把 /old/news/、/old/product/ 这类前缀归到一组,再逐组判断新站是否有对应栏目。分组的意义在于:即使单个地址对不上,同一组地址的处理方式通常可以统一,减少逐个猜测的成本。
第三步是先处理能确认的地址,再处理不能确认的地址。能确认的做单点跳转;不能确认的先保留原地址返回一个说明页,或者暂时不做跳转,等清单补全后再决定。这个动作的结果是:你不会因为急于清理而把仍有访问的地址一次性导向无关页面。
保留的适用前提是旧地址仍可能被访问,且新站存在主题相近的页面。此时用单点跳转把旧地址指向最接近的新页面,比统一跳首页更可控。改写适用于旧地址带有可推断规律的情况,例如旧编号能对应新编号,或旧栏目名在新站有明确对应。改写的风险在于推断错误,所以只对规律清晰的部分使用。
退出的适用前提是旧地址对应的内容确实不再提供,且没有相近页面可替代。退出不等于必须返回错误状态,也可以返回一个说明页面,告诉访问者内容已调整,并给出相关栏目的入口。这样做的结果是访问者仍能继续浏览,而不是直接中断。
如果缺少权限查看旧站配置,就不要断言旧地址一定被外部引用。访问日志里某段时间没有记录,可能只是日志未保留、抓取频率低或访问本身很少,不能单独证明该地址已经无用。
假设旧站有 /old/news/1001.html 到 /old/news/1200.html 共两百个地址,新站新闻栏目改成了 /news/ 加文章标识。你无法确认每个旧编号对应哪篇新文章,但能确认这批旧地址都属于新闻类。此时可执行的最小动作是:把这一组旧地址统一跳转到新站新闻栏目首页,而不是逐个猜测对应关系。
这个动作的结果是:访问者仍能进入新闻栏目,继续查找内容;同时你保留了一份旧地址清单,后续如果能拿到编号对应关系,再把栏目级跳转细化为单点跳转。这里需要说明的是,栏目级跳转只是过渡方案,不能推出“所有旧新闻地址都已正确对应”,也不能推出“以后不需要再细化”。
检查的重点不是跳转数量,而是跳转是否落到相关页面。可以抽查若干旧地址,确认它们跳转后的页面主题是否与旧地址一致。如果发现某组地址跳转后落到明显无关的页面,说明分组判断有误,应回到分组阶段重新划分。
还要检查是否存在循环跳转或跳转到已失效页面。一个旧地址跳转到新地址后,如果新地址又跳回旧地址,访问者会陷入循环。发现这种情况时,应先停用该条跳转,再确认新地址是否有效。
最后,把暂时无法处理的地址单独记录。记录内容包括旧地址、当前处理方式和待确认原因。这样下一步补全数据时,可以直接从这份记录继续,而不必重新收集。