确定影响范围的核心方法,是把“百度不收录”拆成可核对的维度:受影响的是整站还是某个目录,是全部页面类型还是单一模板,是仅新页面还是连老页面也消失。先圈定边界,再决定是修全站配置,还是只处理局部内容。范围没定就动手改,往往会把小问题扩大成整站故障。
“百度不收录”在日常沟通中常被混用,实际对应不同问题,影响范围也完全不同:
判断时不要只看一个页面。至少抽取首页、栏目页、详情页各若干条,分别记录“能否搜到”,才能看出是点状问题还是面状问题。
要确定影响范围,最有效的方式是做对照,而不是凭感觉判断。可以按下面四组维度逐项核对:
/news/、/product/、/help/,每组抽 5 到 10 个 URL 检查收录情况。若只有 /news/ 异常,范围就锁定在该目录。四组对照做完,通常能得出一个具体结论,例如“仅改版后新增的详情页不收录,老页面正常”。这个结论就是影响范围。
范围确定后,常见的选择是“全站统一处理”还是“局部定向处理”。两者没有绝对优劣,取决于范围大小和风险:
/news/ 下的页面不收录。优点是影响可控、便于回滚;缺点是如果实际存在共性问题,可能反复处理仍不见效。判断依据可以简化为一条:异常是否跨越两个以上互不相关的目录或模板。跨越了,优先考虑全站方案;没有跨越,先做局部处理并观察。
无论选哪种方案,动手前先确认以下资料是否齐全,否则无法验收:
验收标准也要提前写清楚,例如“处理后两周内,受影响目录的抽样 URL 在百度搜索中可被检索到”,而不是笼统的“恢复正常”。
假设某站点反馈“百度不收录”,可按以下顺序执行:
/product/ 下 5 条、/news/ 下 5 条,逐条搜索并记录结果。/product/ 正常、/news/ 全部异常,范围锁定为 /news/ 目录。/news/ 是否被 robots.txt 限制、是否在站点地图中、是否有内链入口。/news/ 与其他目录的模板差异,定位到具体差异点。这个流程的价值在于:每一步都产出可核对的结论,而不是一次性大改。若复检后异常仍在,说明范围判断有误,需要回到第一步重新划分维度。
下一步,先把受影响 URL 和正常 URL 各整理成一份清单,按目录和模板标注,再决定采用全站还是局部方案。