如何使用谷歌Chrome插件AMZScoutPro自动提取图表日销售数据
从AMZScoutPro等工具的悬停交互图表自动提取销售数据的可行方案
这类网页端交互图表基本都是基于ECharts、Highcharts等通用可视化库开发,所有数据本身就存储在前端页面的内存中,不需要通过爬虫或者手动记录获取,优先推荐以下方案:
方案1:Chrome控制台直接提取单页数据(无需额外工具,准确率最高)
- 打开AMZScoutPro的目标图表页面,按
F12唤起Chrome开发者工具,切换到「控制台」标签页 - 若图表基于Highcharts开发(AMZScoutPro的图表大多用该库),直接在控制台输入以下代码获取全量数据:
输出的数组中每一项都包含对应日期、销售额的原生字段,直接复制即可整理为表格,也可以额外加代码直接导出为CSV文件。// 打印所有图表的全量数据,若页面只有1个图表取下标0即可 console.log(Highcharts.charts[0].series[0].data) - 若图表基于ECharts开发,先在「元素」面板找到图表对应的DOM节点,替换下方代码的选择器后运行即可:
const chartInstance = echarts.getInstanceByDom(document.querySelector('图表DOM的选择器')) console.log(chartInstance.getOption().series[0].data)
方案2:油猴脚本批量采集多页数据
如果需要采集多个商品的销售数据,可以基于上述逻辑开发轻量油猴脚本,匹配AMZScoutPro的页面规则,页面加载完成后自动提取数据并批量导出,无需手动重复操作控制台代码。
方案3:视觉识别方案(仅适用于前端数据加密的极端情况)
如果遇到前端数据做了加密、无法直接从内存读取的情况,可以用视觉模拟的方式采集:
- 用PyAutoGUI库模拟鼠标依次悬停在每个数据点上,触发tooltip显示
- 同步用Pytesseract或者其他OCR工具识别tooltip内的日期、销售额文本
- 自动对识别结果做结构化整理,该方式准确率可以达到95%以上,远高于静态图表OCR的准确率。
内容的提问来源于stack exchange,提问作者Adel Moin
相关产品推荐
相关产品推荐

