Python使用Selenium爬取表格时XPath行索引跨页面失效如何解决
表格数据爬取行索引适配问题及解决方法
我编写了一个用于数据爬取的脚本,爬取单条信息单独占一行的表格时,脚本循环内使用{i+1}作为XPath的行索引参数读取不同行数据,运行正常。
elements = browser.find_elements_by_id('VisualizarDocumento') for i,registro in enumerate(elements): empresa = browser.find_element_by_xpath(f'//*[@id="grdDocumentos"]/tbody/tr[{i+1}]/td[2]').text tipo = browser.find_element_by_xpath(f'//*[@id="grdDocumentos"]/tbody/tr[{i+1}]/td[4]').text download = browser.find_element_by_xpath(f'//*[@id="grdDocumentos"]/tbody/tr[{i+1}]/td[11]/i[2]').click() sleep(5) print('下载完成')
切换到其他页面后,表格的单条信息会分布在两行中,我尝试将XPath的行索引参数修改为{i+2}后仍然无法正常运行。
最终我找到解决方法,将行索引参数调整为{2*i + 1}即可正常运行。
内容的提问来源于stack exchange,提问作者Frantiescoli Dimer
相关产品推荐
相关产品推荐

