如何阻止爬虫抓取Strapi+Nuxt项目的Admin页面
如何阻止爬虫抓取Strapi Admin页面
你当前的问题核心在于:Strapi Admin部署在admin.mywebsite.com子域名上,但你配置的Disallow:/admin仅对主域名(如mywebsite.com)下的/admin路径生效,对子域名的根目录完全起不到限制作用。
要实现阻止爬虫抓取Strapi Admin页面,按以下步骤操作:
针对子域名单独配置robots.txt
Strapi的静态文件默认存放在项目根目录的public文件夹中,如果没有这个文件夹就新建一个。在public里创建robots.txt,写入内容:User-agent: * Disallow: /这样可以禁止所有爬虫抓取admin.mywebsite.com子域名下的所有内容(因为Strapi Admin的所有页面都在该子域名的根路径下)。
验证配置是否生效
部署完成后,访问https://admin.mywebsite.com/robots.txt,确认能看到你配置的内容。如果无法访问,检查Strapi的静态文件服务配置,或服务器是否正确将子域名映射到Strapi项目。额外安全加固建议
robots.txt只是"建议"爬虫停止抓取,恶意爬虫可以直接忽略它。更稳妥的方式是确保Strapi Admin的身份验证在生产环境正常启用,同时可以在服务器(如Nginx)层面设置IP白名单,仅允许特定IP访问Admin页面。
内容的提问来源于stack exchange,提问作者maipo89
相关产品推荐
相关产品推荐

