TrackJS如何基于User Agent中的token配置忽略规则 无需JS实现
TrackJS 无JS过滤特定User-Agent错误解决方案
你此前配置的忽略规则未生效,核心原因是匹配了TrackJS解析后的浏览器字段,而非原始用户代理字符串。示例中的谷歌朗读爬虫就会被解析为普通Chrome Mobile,无法直接通过解析后的浏览器字段识别:
Mozilla/5.0 (Linux; Android 7.0; SM-G930V Build/NRD90M) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/59.0.3071.125 Mobile Safari/537.36 (compatible; Google-Read-Aloud; +https://support.google.com/webmasters/answer/1061943)
Chrome Mobile 59.0.3071
无需使用JS,仅通过TrackJS内置的忽略规则即可实现需求,配置步骤如下:
- 进入TrackJS控制台的「设置」>「忽略规则」页面
- 新建忽略规则,匹配字段选择
原始用户代理(Original User Agent),不要选择解析后的浏览器相关字段 - 匹配条件选择「包含」,值填写你需要过滤的特定token,例如示例中的
Google-Read-Aloud,如果需要过滤其他爬虫,对应填写对应的标识即可 - 保存规则后可使用平台自带的规则测试功能,粘贴目标UA字符串验证匹配是否生效
如果需要过滤多类不同的爬虫,可对应创建多条忽略规则,即可完成全量过滤。
内容的提问来源于stack exchange,提问作者Alexandr Vysotsky
相关产品推荐
相关产品推荐

