Facebook页面评论作者获取规则变更后第三方服务实现方式问询
嘿,这个问题问到点子上了!自从2018年2月Meta(原Facebook)调整规则后,用普通方式通过Graph API拿评论作者信息确实必须要Page access token,但像brand24这类社交媒体监控工具还能提供这类数据,主要有这几种可行的路径:
网页抓取(Web Scraping):这是最容易想到的方案。Facebook的公共页面评论在网页端是完全公开的,任何人不用登录都能看到。这类工具可以模拟浏览器请求页面,然后解析页面的HTML结构,提取出评论作者的名字、头像、发布时间甚至个人主页链接这些信息。不过要注意,这种方式有不少限制:Facebook的页面结构经常更新,工具得跟着调整解析逻辑;而且Meta有反爬机制,频繁抓取可能会被封IP;另外robots.txt也可能限制这类抓取行为,合规性存疑。
官方合作/企业级授权:很多做社交媒体监听的工具属于企业级服务,他们可能和Meta达成了官方合作,拿到了特殊的批量数据访问权限。这种情况下,他们不需要为每个单独的页面申请Page access token,就能合法获取大量公共页面的评论及作者信息。这类授权一般只对大型企业开放,普通开发者很难拿到。
依托用户提供的权限令牌:另一种合规的方式是,使用工具的用户自己提供目标页面的Page access token。比如某个品牌用这类工具监控自己的Facebook官方页面,他们可以把自己的页面令牌给到工具,工具就可以用这个令牌调用Graph API,合法获取该页面下所有评论的作者信息。这种方式完全符合Meta的规则,而且对工具来说不需要自己去搞定每个页面的权限,只需要做好用户引导就行。
利用遗留权限或边缘场景(可能性较低):虽然概率不高,但不排除有些早期的应用还保留着2018年之前的权限,或者存在一些API的边缘场景,在特定条件下还能返回用户信息。不过Meta近几年对权限管控越来越严格,这类漏洞一般会被快速修复,很难作为长期稳定的方案。
总的来说,合规的工具肯定会优先选择官方合作或者用户提供令牌的方式,网页抓取更多是备选或者补充方案,毕竟违规操作风险太高了。
内容的提问来源于stack exchange,提问作者Vinz

