把网站死链查询做成可复用检查清单,关键不是记住某个工具,而是固定一套“发现—判断—处理—复查”的流程,并记录每次判断依据。这样换一个站点、换一个人执行,也能得到相近结果。
死链通常指返回 404、410 的页面,也包括被服务器拒绝、超时或跳转到错误页面的链接。检查前先定义范围:只查站内链接,还是同时查外链;只查页面正文,还是包含导航、页脚、图片和下载文件。范围不同,工具和结果都会不同。
可以先用一个假设例子说明:某页面正文里有一个指向旧活动的链接,点击后返回 404,而导航里的同一路径返回 301 跳转到新页面。前者应记为待修复死链,后者应记为待确认的跳转,而不是直接算死链。
单一工具的结果不能直接当作结论。建议至少交叉核对三类来源:
判断时区分“可能原因”和“已经定位的原因”。例如,某链接返回 404,可能是页面被删除、路径拼写错误、大小写不一致,也可能是服务器配置问题。只有查看日志、源文件和响应头后,才能确定具体原因。
把结果分成三类处理:
修复时同步检查 robots.txt 是否误屏蔽了目标路径。抓取限制不等于可靠的索引移除,屏蔽一个仍被引用的地址,可能让问题更难被发现。站点地图也不保证收录,它只能帮助发现页面,不能替代死链修复。
每次处理完,记录以下字段,形成可复用模板:检查日期、页面地址、链接地址、返回状态、最终地址、判断结论、处理动作、复查日期。复查时重新跑一遍相同范围,对比新增和已修复项。
检查项可以固定为:
如果站点使用 HTTPS,仍需单独确认证书有效和页面内容正确。HTTPS 不保证安全无漏洞,也不直接保证排名,它只是检查清单中的一项基础条件。
先选一个现有页面,按上面的检查项跑一遍,把结果填入模板;再把这个模板复制到下一个页面。跑过三到五个页面后,根据实际误判和遗漏调整字段,清单就基本可复用了。