如何修复WordPress网站Lighthouse检测出的‘链接不可抓取’错误?
解决Lighthouse“Links are not crawlable”告警的方案
检查锚元素的href属性合法性
逐个排查页面上的<a>标签:- 避免使用空href(
<a href="#">或<a href="">)、javascript:伪协议(<a href="javascript:void(0)">),这类链接搜索引擎无法解析有效目标; - 确保href指向真实可访问的URL(绝对路径或相对路径均可),比如
<a href="/about">关于我们</a>而非仅靠JS绑定点击事件跳转; - 对于锚点链接,要确保页面上存在对应的
id目标,比如<a href="#section1">跳转至第一部分</a>需对应<div id="section1">。
- 避免使用空href(
确认链接未被抓取限制
- 检查CSS是否通过
display: none、visibility: hidden或opacity: 0等方式隐藏链接,搜索引擎可能忽略不可见的锚元素; - 查看
robots.txt文件,确认没有禁止抓取这些链接指向的页面; - 检查目标页面的meta标签,确保没有设置
<meta name="robots" content="noindex">,这类标签会阻止搜索引擎收录该页面。
- 检查CSS是否通过
重新验证站点地图的准确性
即使站点地图提交成功,也要核对:- 站点地图中的URL是否与实际页面URL完全一致(注意大小写、HTTP/HTTPS协议、末尾斜杠等细节);
- 目标页面是否能正常访问,返回200状态码,避免404、500等错误;
- 站点地图是否包含了所有需要被抓取的页面,没有遗漏动态生成的页面。
排查JavaScript渲染的链接问题
如果是SPA(单页应用)或动态渲染的页面:- 确保链接在初始HTML中就存在,而非完全通过客户端JS动态插入;
- 若使用前端路由,优先采用符合规范的URL格式(如
/blog/post-1而非#/blog/post-1的哈希路由),并确保服务器能正确返回对应页面内容; - 可以使用Google Search Console的“测试移动友好性”工具,查看搜索引擎渲染后的页面是否能正常识别链接。
利用工具定位具体问题
使用Google Search Console的URL检查工具,输入告警中提到的链接,查看抓取详情:- 工具会显示搜索引擎抓取该链接时的状态、是否被阻止、渲染结果等信息,精准定位问题所在;
- 同时可以在Lighthouse报告中点击告警详情,查看具体是哪些链接触发了问题,针对性修复。
内容的提问来源于stack exchange,提问作者Caroline Zhao
相关产品推荐
相关产品推荐

