You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python使用Selenium爬取表格时XPath行索引跨页面失效如何解决

表格数据爬取行索引适配问题及解决方法

我编写了一个用于数据爬取的脚本,爬取单条信息单独占一行的表格时,脚本循环内使用{i+1}作为XPath的行索引参数读取不同行数据,运行正常。

elements = browser.find_elements_by_id('VisualizarDocumento')
for i,registro in enumerate(elements):
    empresa = browser.find_element_by_xpath(f'//*[@id="grdDocumentos"]/tbody/tr[{i+1}]/td[2]').text
    tipo = browser.find_element_by_xpath(f'//*[@id="grdDocumentos"]/tbody/tr[{i+1}]/td[4]').text
    download = browser.find_element_by_xpath(f'//*[@id="grdDocumentos"]/tbody/tr[{i+1}]/td[11]/i[2]').click()
sleep(5)

print('下载完成')

切换到其他页面后,表格的单条信息会分布在两行中,我尝试将XPath的行索引参数修改为{i+2}后仍然无法正常运行。

最终我找到解决方法,将行索引参数调整为{2*i + 1}即可正常运行。


内容的提问来源于stack exchange,提问作者Frantiescoli Dimer

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.02 23:39:03