无需web scraping如何拉取网站数据并同步更新至自有站点
适配需求的3种简便实现方法
- 前端JS直接调用官方公共API(最省事,无需服务器、无需爬虫)
这个站点本身开放了免鉴权、支持跨域的公共数据接口,你不需要爬页面,直接请求对应4个主面板指标的接口,就能拿到已经格式化好的官方统计值。刚好你的2×4表格可以第一行放4个指标的统计数值,第二行放对应更新时间,完全匹配需求。
你只需要在自己站点的页面里加一段原生JS代码就行,每次用户打开页面都会自动拉最新数据填充到表格,全程自动同步:// 4个指标分别请求,或者找批量返回4个指标的接口 async function fillCovidTable() { // 下面的接口路径替换为你要的4个指标对应的官方API路径 const targets = ['指标1接口', '指标2接口', '指标3接口', '指标4接口']; for (let i = 0; i < targets.length; i++) { const res = await fetch(targets[i], { mode: 'cors' }); const data = await res.json(); // 给你的表格单元格提前设好id,比如value1、time1对应第一个指标的数值、更新时间 document.getElementById(`value${i+1}`).textContent = data.formattedValue; document.getElementById(`time${i+1}`).textContent = data.lastUpdate; } } window.addEventListener('load', fillCovidTable); - 无代码定时同步方案(完全不用写代码)
用无代码自动化工具设置定时任务,按照目标站点的更新频率,定时拉取4个主面板的固定位置数据,直接写入你自有站点表格绑定的数据源,全程自动运行,不需要你手动操作。 - 静态站点预拉取方案
如果你的站点是纯静态的不想加动态JS,可以用静态站点生成器的构建钩子,每次站点部署前自动拉取最新的4项数据写入到表格对应的位置,你只要定期触发一次部署就能同步最新数据,不用手动修改页面内容。
仅私用场景下使用该数据,符合站点公共数据的非商用使用规则,无需额外申请授权。
内容的提问来源于stack exchange,提问作者Sebastian Fisher
相关产品推荐
相关产品推荐

