制作链接检查清单的核心,是把“这个外链到底有没有用、有没有风险、能不能长期存在”拆成可逐项核对的字段。清单不是简单记录网址,而是记录来源页面、链接形态、页面可访问性、内容相关性和证据截图。按下面五组检查项执行,就能在出现排名波动、收录异常或外链效果不符预期时,快速定位是链接本身的问题,还是页面或抓取层面的问题。
一份能用于排查的清单,至少包含以下列:来源页面URL、目标页面URL、锚文本、链接类型(dofollow或nofollow)、首次发现日期、最近复查日期、页面状态码、是否可被搜索引擎抓取、来源页主题、备注与证据文件。字段不全,后续排查就只能靠印象。
制作方法:用表格工具建一张表,第一行写字段名,每个外链占一行。如果同一来源页有多个链接指向不同目标页,分行记录,不要合并。适用条件是外链数量在几十到几百条之间,手工维护仍然可控;如果数量更大,应先按来源域名分组,再决定是否引入脚本批量检查。
要查什么:来源页面是否返回正常状态、目标链接是否仍在页面HTML中、锚文本是否被改动。
怎么查:用浏览器打开来源页,按Ctrl+U查看源代码,搜索目标URL或锚文本。再用命令行检查状态码,例如curl -I 来源页URL,看返回的是200、301还是404。注意,页面能打开不代表链接还在,必须回到源码确认。
结果说明什么:返回404或链接已从源码消失,说明这条外链已经失效,应标记为“丢失”;返回301说明来源页跳转,链接价值可能随跳转链路衰减,需要记录最终落地页;源码中链接存在但被nofollow或sponsored标注,说明它不传递常规权重,但仍可能带来 referral 流量,应单独归类。
要查什么:来源页有没有被robots.txt屏蔽、有没有加noindex、是否被canonical指向其他页面。
怎么查:打开域名/robots.txt,看目标路径是否落在Disallow规则内;查看来源页HTML的<meta name="robots">标签;查看<link rel="canonical">指向的URL是否与当前页一致。
结果说明什么:如果来源页被robots屏蔽或标了noindex,搜索引擎不会把它作为正常索引页面处理,外链的发现和传递都可能受影响;如果canonical指向另一个页面,权重信号可能被归并到规范页,你记录的这条链接就不代表实际生效页面。这三种情况要分别记录,不能都写成“外链无效”。
要查什么:来源页主题是否与目标页接近、链接出现在正文还是页脚或侧栏、周围是否有大量导出链接。
怎么查:人工阅读来源页标题、首段和所在段落,判断主题是否相关;在源码中定位链接所在的容器标签,看它处于<article>、<p>还是<footer>;统计同页导出链接总数。
结果说明什么:正文中的编辑性链接,通常比页脚、友情链接区或全站模板链接更可能被视为自然推荐;同页导出链接过多,单条链接能分到的信号会被稀释。相关性弱不等于一定有害,但如果一批外链都来自无关主题的聚合页,应把它们归入“低相关”组,优先复查。
清单建好后,按固定节奏复查:新获取的外链在7天内做首次核验,之后每月抽查一次,重点来源每季度完整复查。每次复查更新“最近复查日期”和“状态”两列。
证据要落地:对关键外链保存来源页截图、源码片段和状态码输出,文件名用日期加来源域名,例如2025-06-01-example.com-200.txt。假设某条外链在复查时返回404,而截图显示此前为200,就能判断是来源页被删除,而不是一开始就无效——这就是清单加证据的价值。
下一步:先按上面的字段建好表格,把最近三个月获取的外链逐条录入,再对状态为“丢失”“noindex”“canonical指向他页”的条目优先处理,决定是联系对方修复、移除记录,还是保留观察。