You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用IMPORTXML获取特定域名页面参数时出现Could not fetch URL问题求助

解决IMPORTXML "Could not fetch URL" 错误的常见方案

原因1:目标网站反爬拦截

现在多数网站会识别非浏览器的请求,Google Sheets的IMPORTXML默认请求头容易被判定为爬虫拦截。可以用Google Apps Script模拟浏览器请求绕过:

function fetchCasinoStatus(url) {
  var options = {
    headers: {
      'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/114.0.0.0 Safari/537.36'
    }
  };
  try {
    var response = UrlFetchApp.fetch(url, options);
    var html = response.getContentText();
    // 可根据页面实际结构调整正则,匹配状态文本
    var statusMatch = html.match(/<div class="casino-status[^>]*>\s*<span>([^<]+)<\/span>/);
    return statusMatch ? statusMatch[1] : '状态未找到';
  } catch (e) {
    return '请求失败: ' + e.toString();
  }
}

添加脚本后,在表格单元格调用:=fetchCasinoStatus("https://www.askgamblers.com/online-casinos/reviews/winning-casino")

原因2:页面结构变动导致XPath失效

你两年前用的绝对XPath(比如/html/body/div[4]/div[1]/div/span)依赖固定页面层级,网站更新后基本会失效。重新获取有效XPath的步骤:

  1. 打开目标赌场页面,按F12打开开发者工具
  2. 找到显示状态的span元素,右键选择「复制」→「相对XPath」
  3. 把新的相对XPath替换到IMPORTXML公式中,比如可能是//div[contains(@class,'casino-status')]/span

原因3:Google Sheets请求限制

如果短时间内多次用IMPORTXML请求同一网站,Google可能会暂时限制请求。可以间隔一段时间再试,或者把请求分散到不同单元格分批执行。

内容的提问来源于stack exchange,提问作者user2240778

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.11 02:35:35