Python网络爬取问题:使用get函数读取Excel单元格URL失败
解决Excel读取URL后无法保存爬取结果的问题
你的代码已经完成了URL读取、网页请求和数据解析的全部步骤,但爬取结果没有写入到Excel文件中,核心原因是缺少Excel文件的保存操作。
修正后的完整代码
import requests from bs4 import BeautifulSoup from openpyxl import load_workbook workbook = load_workbook(filename="tennis3.xlsx") sheet = workbook.active urlcell = sheet["A1"].value # 可选:添加打印验证URL是否正确读取 # print(urlcell) response = requests.get(urlcell) webpage = response.content soup = BeautifulSoup(webpage, "html.parser") sheet["B1"] = soup.select('h1 a')[0].text.replace(' ','_') # 关键步骤:将内存中的修改写入实际文件 workbook.save("tennis3.xlsx")
核心说明
- 使用openpyxl操作Excel时,所有对工作簿的修改仅存在于内存中,必须调用
workbook.save()方法,才能把修改内容持久化到本地Excel文件。 - 若之前怀疑
sheet["A1"].value读取失败,可通过print(urlcell)打印读取内容,快速验证URL是否被正确获取,排除读取环节的问题。
内容的提问来源于stack exchange,提问作者NewGuy1
相关产品推荐
相关产品推荐

