先给结论:如果旧地址能找到内容主题接近、且用户意图基本一致的页面,优先做一对一的永久重定向;如果找不到这样的目标,就返回410或保留一个说明页,而不是把大量旧地址统一甩到首页。判断的关键不是“能不能跳”,而是“跳过去之后用户是否能完成原来想做的事”。
迁移时最常见的情况是旧页面被拆分成多个新页面,或者旧栏目被合并。这时要看的不是标题相似度,而是用户到达旧地址时的原始意图是否还能被满足。
实际操作上,可以先把旧地址按“有等价目标”“有近似目标”“无目标”三档归类。这个动作的结果会直接决定下一步:前两档进入重定向映射表,第三档进入410或保留页清单。分类没做完就批量配置规则,后面很难回头核对。
把找不到目标的旧地址全部301到首页,看起来省事,代价是用户和抓取工具都会把大量不相关的旧地址视为同一个目标。对用户来说,进入首页后仍需重新搜索;对站点来说,这些旧地址失去区分度,后续再想单独处理某个旧栏目就没有干净入口了。
一个可区分的反例是:旧地址本身是带参数的筛选结果页,例如假设的 <span>?type=pdf&year=2023</span> 这类组合。这类地址数量可能很大,且没有稳定的独立内容。把它们全部跳首页,和返回410,在用户侧差别不大,但在维护侧差别明显:410清单更短,规则更容易审计。这里的前提是这些地址确实没有独立内容价值;如果其中某些组合页曾被外部引用,就需要单独确认,而不能一并归入410。
三者不是按“礼貌程度”排序,而是按内容是否还会回来、用户是否还有替代路径来选。
需要提醒的是,robots.txt 的抓取限制不等于可靠的索引移除。即使屏蔽了抓取,旧地址仍可能以其他形式出现在结果中。因此不要用 robots 规则替代410或重定向决策。
配置完成后,至少要做两件事:抽查旧地址的实际响应,以及观察这些地址在站内日志中的后续请求。抽查时记录每个旧地址返回的状态码和最终落地地址,和映射表逐条对照。
如果发现某个旧地址请求量下降,不能单独据此证明处理正确。请求量归零还可能是因为抓取频率整体变化、外部链接被移除、或该地址本来访问就少。要结合落地页的访问情况、站内搜索词和外部引用变化一起看。
站点地图不保证收录,提交新地址地图也不代表旧地址问题已经解决。迁移验证的重点始终是旧地址本身的响应,而不是新页面是否被提交。
假设某批旧地址中,一部分能对应到主题一致的新页面,一部分只能对应到栏目页,还有一部分完全没有对应内容。可以按以下顺序处理:
做完这一步后,下一步不是继续加规则,而是回头核对映射表里是否存在多个旧地址指向同一新地址、且这些旧地址意图并不一致的情况。这类冲突会让后续的日志分析失去区分度,越早拆开越省事。