先给结论:如果这次变化只影响展示分、不影响你实际要交付的结论,保留旧记录并加一条差异说明就够了;如果变化会改变你下一步的动作,比如某个页面从"可放行"变成"要先改",那就必须重跑并留下新基线。判断的关键不是分数高低,而是旧结论还能不能支撑你的决策。
同一个工具升级后分数下降,常见原因有三类,指向的动作完全不同。
区分方法很直接:挑三到五个你确定近期没动过的页面,看它们的分数是否也一起变了。如果连这些"静止样本"都同向变化,基本可以归为口径问题;如果静止样本稳定、只有改动过的页面波动,那是站点自身的问题。抓取类变化还会伴随样本数异常,这类情况下的分数差异参考价值最低。
选择保留,意味着你接受"旧结论仍然可用",代价是未来对比时会出现一段口径不一致的区间,需要额外说明。它成立的条件是:
满足这些条件时,实际动作是:在旧记录旁加一行说明,写清变动时间和疑似原因,然后继续按原清单执行。这样做的结果是历史链路完整,但你必须接受一个后果——下次再拿新分数和这批旧分数对比时,差异里混着口径变化,不能直接当成绩效。
重跑的代价是时间,以及旧新数据无法直接相减。但只要出现下面任一情况,这个代价就该付。
重跑的正确做法不是只跑一次拿新分,而是固定同一批样本页面,记录新旧两套结果,把"因口径变化产生的差异"和"因站点改动产生的差异"分开列。这样得到的新基线才有解释力。
假设你手上有 40 个页面,旧报告显示 32 个达标、8 个待改。工具升级后重跑,变成 25 个达标、15 个待改。此时不要直接得出"站点退步了"的结论。
先取其中 5 个你确认从未修改过的页面:如果它们也从未达标变成待改,说明是判定口径收紧,那 7 个新增待改页面里,可能有一部分只是被新规则扫到,实际影响有限,处理优先级可以往后放。如果这 5 个静止页面仍然达标,只有改动过的页面掉下来,那这 7 个就是真实的整改任务,应当排进当前工作队列。
这个判断动作的结果,直接决定你是更新整改清单,还是只更新说明文档。前者改变执行人员的任务量,后者不改变。
还有一种情况:如果升级后的评分项和你的实际目标长期对不上,比如它反复提示的维度你根本不考核,而你在意的维度它又不体现,那么继续围绕这个分数做决策就是在为工具服务,而不是为站点服务。
退出不等于弃用工具,而是把它降级为参考项,改用你自己定义的一组检查点作为主基线。适用前提是你已经能稳定定义"什么算达标",否则换一套评分只会带来同样的困惑。具体某个工具当前有哪些检测项、是否收费、入口在哪,需要以你实际看到的版本为准去核对,不要依赖旧教程里的描述。
无论保留、重跑还是退出,共同的动作都是把"分数变化"翻译成"哪个页面、哪个判断、下一步做什么"。翻译不出来的差异,不值得为它调整任何执行计划。