如何随机抓取符合粉丝数条件的Instagram公开账号并生成约1000个的列表
随机Instagram公开账号(支持粉丝数筛选)生成方案
注意:所有对Instagram平台的数据抓取行为需遵守Meta平台的《服务条款》及当地数据合规要求,请勿用于非法用途。
方案1:官方Graph API(首选,无反爬风险)
这是最稳定的实现方式,无需担心账号/IP封禁:
- 前置准备:注册Meta开发者账号,创建应用并申请Instagram Basic Display API的对应访问权限
- 实现流程:
- 通过搜索端点按指定关键词、话题、地区维度拉取公开账号的基础ID列表
- 调用账号详情接口,获取
followers_count粉丝数字段,匹配你设置的筛选区间 - 将符合要求的账号信息(用户名、ID、粉丝数等)存入字典,直到累计到1000条即可
- 参考代码片段(Python):
import requests # 替换为你自己的有效API访问令牌 ACCESS_TOKEN = "YOUR_VALID_ACCESS_TOKEN" # 自定义粉丝数筛选阈值 MIN_FOLLOWERS = 500 MAX_FOLLOWERS = 50000 valid_accounts = [] def fetch_and_filter_accounts(search_keyword): # 调用API搜索相关账号,解析返回数据 # 遍历返回的账号列表,拉取每个账号的粉丝数详情 # 符合阈值的账号追加到valid_accounts列表中 pass
方案2:第三方爬虫实现(需应对反爬)
你之前使用的insta-scrape已经停止维护,无法适配Instagram最新的前端反爬规则,建议按以下逻辑实现:
- 前置准备:配置高匿代理IP池、随机User-Agent池,准备少量备用测试账号
- 实现流程:
- 从热门话题、公共地点标签的动态发布列表入手,批量采集发布动态的公开账号ID
- 控制请求频率,间隔10秒以上请求单个账号的公开主页,解析页面中的粉丝数字段
- 符合筛选条件的账号存入结果集,直到凑够1000条有效数据
- 注意事项:
- 每发出20次请求更换一次代理IP,避免触发IP封禁
- 遇到隐私账号直接跳过,不要重复请求
- 尽量选择平台低峰时段抓取,可大幅提升成功率
内容的提问来源于stack exchange,提问作者Omar
相关产品推荐
相关产品推荐

