You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python网络爬取问题:使用get函数读取Excel单元格URL失败

解决Excel读取URL后无法保存爬取结果的问题

你的代码已经完成了URL读取、网页请求和数据解析的全部步骤,但爬取结果没有写入到Excel文件中,核心原因是缺少Excel文件的保存操作。

修正后的完整代码

import requests
from bs4 import BeautifulSoup
from openpyxl import load_workbook

workbook = load_workbook(filename="tennis3.xlsx")
sheet = workbook.active
urlcell = sheet["A1"].value

# 可选:添加打印验证URL是否正确读取
# print(urlcell)

response = requests.get(urlcell)
webpage = response.content

soup = BeautifulSoup(webpage, "html.parser")

sheet["B1"] = soup.select('h1 a')[0].text.replace(' ','_')

# 关键步骤:将内存中的修改写入实际文件
workbook.save("tennis3.xlsx")

核心说明

  • 使用openpyxl操作Excel时,所有对工作簿的修改仅存在于内存中,必须调用workbook.save()方法,才能把修改内容持久化到本地Excel文件。
  • 若之前怀疑sheet["A1"].value读取失败,可通过print(urlcell)打印读取内容,快速验证URL是否被正确获取,排除读取环节的问题。

内容的提问来源于stack exchange,提问作者NewGuy1

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.14 12:31:00