You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在博客中隐藏姓名防Google爬虫抓取?求优化方案

博客隐藏姓名规避Google爬虫的可行方案

现有方案的问题

目前采用字母加圆点拆分姓名(如l.i.k.e t.h.i.s.),虽能阻止爬虫识别,但可读性极差,视觉体验糟糕。

针对疑问的解答

1. 用<em>包裹圆点再通过CSS隐藏的风险

会直接暴露姓名。Google爬虫会剥离HTML标签读取文本内容,隐藏的圆点会被忽略,最终爬虫看到的是完整的姓名字符串,完全达不到隐藏效果。

2. 源码保留圆点、JS前端去除的爬虫识别情况

Google爬虫会执行页面中的JavaScript代码,最终抓取到的是JS处理后的无圆点姓名,同样会暴露姓名,这个方案不可行。

可行替代方案

  • 字符替换法:用视觉上高度相似的特殊字符替代部分字母,比如把o换成西里尔字母о,l换成全角字符l,人类肉眼难以区分,但爬虫的字符识别系统会判定为不同字符,无法拼接成有效姓名。
  • CSS文字偏移法:将姓名拆分成单个字符,通过text-indent或transform: translateX()让部分字符轻微偏移,整体视觉上连贯正常,但爬虫读取文本时会因字符位置异常,无法识别为完整姓名。
  • 图片嵌入法:把姓名做成图片嵌入页面,而非使用纯文本。普通场景下爬虫无法直接识别图片中的文字,还可以给图片设置无关的alt属性,进一步降低被识别的概率。
  • PHP零宽字符插入法:后端用PHP在姓名的字母之间随机插入零宽字符(如\u200B),前端显示时零宽字符不占用空间,姓名显示正常,但爬虫读取的文本包含零宽字符,无法被识别为有效姓名。

内容的提问来源于stack exchange,提问作者thomas

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.29 00:02:04