You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

能否用Google Spreadsheet的IMPORTXML提取网页非表格类餐厅评分?

用Google Sheets提取网页非结构化评分数值的方法

Google Sheets完全可以提取这类不在表格、列表里的特定数值,核心是用IMPORTXML函数搭配精准的XPath定位,具体操作如下:

  • 第一步:获取评分元素的精准XPath
    打开目标Tabelog页面,右键点击评分(3.43)选择「检查」,找到该数值对应的HTML元素(通常是带特定class的<span>标签)。以你提供的示例页面为例,评分对应的HTML元素是<span class="rdheader-rating__score">3.43</span>,对应的XPath就是//span[@class='rdheader-rating__score']。

  • 第二步:在Google Sheets中编写公式
    在任意单元格输入以下公式:

    =IMPORTXML("https://tabelog.com/tw/osaka/A2701/A270202/27018948/", "//span[@class='rdheader-rating__score']")
    

    如果需要把提取到的内容转为纯数值格式,用VALUE()包裹即可:

    =VALUE(IMPORTXML("https://tabelog.com/tw/osaka/A2701/A270202/27018948/", "//span[@class='rdheader-rating__score']"))
    
  • 注意事项
    如果页面结构后续有变动,原XPath可能失效,此时需要重新检查元素更新XPath;另外,确保Google Sheets能正常访问目标网站(Tabelog这类站点一般允许这类合理的内容提取)。

之前遍历表格和列表失败是因为评分不在这些结构化元素里,直接定位到承载评分的具体HTML元素才是正确的思路。

内容的提问来源于stack exchange,提问作者Dave

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.28 10:52:10