使用Python+Selenium爬虫无法将数据写入Excel问题求助
解决Selenium爬取数据写入CSV的问题
嘿,我来帮你搞定这个写入CSV的问题!你遇到的<selenium.webdriver.remote.webelement.WebElement...>内容,是因为你直接把Selenium的WebElement对象转成字符串写入了,而不是提取元素里的文本内容。另外你的代码还存在一个问题:当前的XPath只定位到了单场比赛的队伍,没法获取所有赛事数据。下面我给你调整一下代码,解决这些问题:
问题拆解
- 核心错误:你写入的是
WebElement对象本身,而不是对象中的文本内容,需要用.text属性提取元素显示的文字 - 定位缺陷:原XPath指向的是某一场特定比赛的动态ID(
g_1_8ClzUOIT这类ID会随页面加载变化),应该用相对定位遍历所有比赛行
修改后的代码
from selenium import webdriver import csv # 用csv模块处理写入更规范,避免格式混乱 chrome_path = r"F:\Python\chromedriver.exe" driver = webdriver.Chrome(chrome_path) driver.get("https://www.flashscore.ro/fotbal/franta/ligue-1/meciuri/") # 获取所有比赛行(定位到每个比赛对应的tr元素) match_rows = driver.find_elements_by_xpath('//*[@id="fs-fixtures"]/table[1]/tbody/tr') filename = "lista campionate.csv" # 用with语法自动管理文件,指定utf-8编码避免乱码 with open(filename, "w", newline="", encoding="utf-8") as f: writer = csv.writer(f) # 写入表头(罗马尼亚语表头,可按需调整) writer.writerow(["Echipa Acasă", "Echipa Oaspeți"]) for row in match_rows: # 在当前行内相对定位主场、客场队伍,避免全局定位拿到重复内容 home_team = row.find_element_by_xpath('./td[3]').text away_team = row.find_element_by_xpath('./td[4]').text # 打印验证结果 print(f"{home_team} vs {away_team}") # 写入单行数据 writer.writerow([home_team, away_team]) driver.quit() # 记得关闭浏览器进程,避免资源占用
额外提示
csv模块会自动处理CSV的格式规则,比如内容里的逗号会被正确转义,比直接用open写入更稳妥- 相对XPath(
./td[3])是在当前比赛行内查找元素,不会误拿到其他行的内容 with open语法不需要手动调用f.close(),代码更安全可靠
内容的提问来源于stack exchange,提问作者Mihai
相关产品推荐
相关产品推荐

