Google索引采用最终URL还是原始链接?Drupal站点参数URL收录疑问
核心结论
你描述的场景下,Google的收录逻辑取决于带q参数的URL跳转到友好URL时返回的HTTP重定向类型:
- 若为301永久重定向:Google几乎只会收录最终的友好URL,不会保留带
q参数的原始链接索引,同时会把原始链接的权重全部转移到目标友好URL - 若为302临时重定向:短期内可能存在两个URL都被抓取收录的概率,但长期仍会优先识别跳转后的友好URL作为主收录地址
彻底屏蔽带q参数URL收录的方案
如果你要完全避免Google爬取大量筛选参数生成的无用页面,只保留友好URL的收录,可以叠加以下四层防护:
- 首先确认Drupal的重定向配置:所有带
q=参数的筛选/分类URL,跳转到对应友好URL时返回301永久重定向,从HTTP协议层给Google明确的信号 - 在站点根目录的
robots.txt中添加屏蔽规则,直接禁止Google爬虫抓取所有带q参数的URL:
Disallow: /*?q=*
- 给所有分类页、产品页的HTML头部添加canonical标签,标签的href属性固定为当前页的友好URL,就算Google爬虫意外拿到带参数的URL,也会根据canonical标签确认唯一的收录地址,完全杜绝重复收录风险
- 可在Google Search Console的URL参数配置项中,将
q参数设置为「不影响页面内容」,让Google主动放弃爬取带该参数的URL,进一步降低无用爬取消耗
Drupal 7适配提示
Drupal 7开启干净URL(Clean URL)功能后,本身就原生支持q参数到友好URL的重定向,你仅需修改筛选区块的链接生成逻辑,不需要额外开发重定向功能,确认重定向状态码为301即可正常使用。
内容的提问来源于stack exchange,提问作者Justin Dunkley
相关产品推荐
相关产品推荐

