如何检查网站死链_用可复用清单把检查变成固定流程

📍 WDQWDWQD987AAAAA:216.73.217.121
📱 Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; ClaudeBot/1.0; +claudebot@anthropic.com)
🔗 /bce45e68a7c2.html
📄

如何检查网站死链_用可复用清单把检查变成固定流程

要形成可复用的死链检查清单,核心不是记一份“工具名单”,而是把检查拆成固定对象、固定判断和固定记录三部分:每次检查都从同一批入口页和链接来源出发,对每个异常链接确认返回状态、跳转终点和页面内容是否匹配,再把结果写进同一张表。这样换一个人、换一个时间点,也能按同样步骤复现结论。

先纠正一个常见误解:死链不等于“打不开的页面”

很多人第一次做检查时,会逐条点开链接,看到浏览器能显示内容就认为没问题。这个做法漏掉了三类情况:第一,链接返回 301 或 302 跳转,最终落到一个与锚文本无关的页面,用户点“产品价格”却到了首页;第二,链接返回 200,但页面内容是空模板或“暂无内容”,对用户和抓取都近似无效;第三,链接在浏览器里能打开,是因为浏览器带上了登录状态或缓存,而搜索引擎抓取时拿到的是 404 或 403。

所以清单的第一条判断依据应当是服务器返回状态码加最终落地地址,而不是肉眼可见与否。这里要区分“可能原因”和“已经定位的原因”:某个链接打不开,可能是原页面被删除、可能是服务器临时故障、也可能是跳转链路过长,只有拿到状态码和跳转路径后才能确定是哪一个。

清单第一层:确定检查范围和链接来源

可复用的前提是范围固定。建议每次检查都覆盖以下来源,并在表格里标注来源类型,便于后续判断影响面:

如果站点规模较大,不必一次全量检查。可以先固定“首页、栏目页、最近更新的若干内容页”作为每轮必查样本,再按月对全量做一次扫描。这样清单既有固定动作,也不会因数量过大而中断。

清单第二层:每个链接要记录哪几项

把下面这张表当作模板,每次检查复用同一列,不要临时加列或改列名,否则历史结果无法对比:

  1. 来源页面URL:链接出现在哪个页面。
  2. 链接地址:被检查的目标地址。
  3. 状态码:如 200、301、404、403、500。
  4. 最终落地地址:发生跳转后实际到达的地址。
  5. 内容是否匹配:落地页主题是否与链接文字一致。
  6. 处理动作:保留、替换、删除、加跳转、报修。
  7. 复查日期:修改后再次确认的时间。

判断规则可以写成条件式:状态码为 404 或 410,直接进入替换或删除流程;状态码为 301 且落地页主题一致,可保留但记录跳转;状态码为 301 但落地页主题不一致,按死链处理;状态码为 403 或 500,先记为待复查,不要立即删除,因为可能是权限设置或临时故障。

清单第三层:用什么方式执行检查

第一次接触这个问题,可以从两种方式里选一种作为起点:

无论用哪种方式,都要注意一点:不同工具的默认设置不同,有的会跟随跳转后只报最终状态,有的会报每一次跳转。清单里应明确写清“本次使用的方式和设置”,否则两次结果无法比较。另外,HTTPS 只表示传输加密,不保证页面安全无漏洞,也不直接决定排名,不能因为地址是 HTTPS 就跳过死链检查。

清单第四层:修复后如何确认可复用

修复不是改完就结束。可复用的清单必须包含复查动作:对每个已处理链接,在修改后的下一个检查周期重新跑一次,确认状态码变为 200 或跳转终点正确,并在表格中更新复查日期。如果同一来源页面反复出现新死链,说明问题出在内容发布或模板环节,应把该来源加入每轮必查项。

假设某页面正文里有一个指向旧活动页的链接,扫描显示 404。按清单处理:先查是否有可替代的新活动页,有则替换链接,无则删除该链接或改为指向栏目页;修改后记录复查日期。下次检查时只验证这一条是否已恢复正常,不必重新判断规则。这就是清单可复用的价值——规则不变,只更新数据。

下一步,先选定一轮检查范围,把上面的表格建好,跑一次完整流程并填满第一行数据。有了第一份可比对的结果,后续每轮检查只需要按同一张表更新状态码和复查日期。

图1 图2

nginx