判断网站死链对SEO影响属于哪一层,核心是分清“链接本身失效”“页面返回状态错误”“抓取与索引被阻断”“站内权重传递中断”四种情况,再按“发现—验证—归因—修复”的顺序逐项检查。多人协作时,建议把每一层写成独立交付项,避免把“链接打不开”直接当成“整站被降权”。
要查什么:某条链接指向的URL是否还能返回正常内容。
怎么查:用浏览器无痕窗口访问该URL,再用命令行或抓取工具查看HTTP状态码,例如curl -I https://example.com/page。
结果说明什么:返回404、410,说明目标资源已不存在;返回301、302,说明发生了跳转,不一定是死链;返回200但内容为空或报错,属于“状态正常、内容异常”,应归入内容层而非死链层。
要查什么:搜索引擎是否已经发现并尝试抓取这些失效URL。 怎么查:在搜索平台提供的抓取统计或索引覆盖报告中,按URL筛选返回404、软404、被屏蔽等状态;同时检查服务器日志中搜索引擎爬虫对失效URL的访问记录。 结果说明什么:若失效URL从未被抓取,影响主要停留在站内用户体验和内部链接结构;若已被频繁抓取并返回错误,才可能消耗抓取预算,并让搜索引擎反复确认该地址不可用。
要查什么:失效URL是否仍在导航、面包屑、文章正文、站点地图或结构化数据中被引用。 怎么查:用站内链接检查工具抓取全站,导出“入链指向404页面”的清单;再人工抽查高价值页面是否链接到失效地址。 结果说明什么:如果只有低价值页面的少量链接失效,影响范围有限;如果首页、栏目页或大量文章都指向同一个404地址,站内链接权重会在此中断,用户路径也会被截断。此时应优先修复高入链死链。
要查什么:失效URL是否被robots.txt限制抓取,是否仍出现在站点地图中,是否提交过索引移除。
怎么查:打开robots.txt核对对应路径是否被Disallow;检查站点地图是否包含已失效URL;在搜索平台查看是否有移除请求记录。
结果说明什么:robots.txt的抓取限制不等于可靠的索引移除,被限制抓取的URL仍可能出现在搜索结果中;站点地图不保证收录,把404地址留在站点地图里只会增加无效抓取。若页面已删除,应让其返回404或410,而不是用robots.txt屏蔽后放任不管。
多人协作时,每一层都应有明确的检查人和验收标准:链接层看状态码,抓取层看日志,链接结构层看入链清单,规则层看配置文件。这样能减少把“页面打不开”和“排名波动”混为一谈导致的返工。
下一步:先选一个高流量栏目,按上述五层各查一遍,把结果写成一张分层表,再决定是修链接、改规则,还是调整内容策略。