获取GitHub技术招聘数据遇groupby报错及存储至Excel问题咨询
报错原因
groupby是Pandas库中DataFrame对象的专属方法,你通过请求接口拿到的data是Python原生列表类型,不具备该方法,因此触发报错。
解决方案
你需要先将拿到的列表数据转换为Pandas DataFrame格式,再执行聚合统计、导出Excel的操作,完整可运行代码如下:
import requests import pandas as pd # 1. 请求接口获取数据 baseurl = "https://cf-courses-data.s3.us.cloud-object-storage.appdomain.cloud/IBM-DA0321EN-SkillsNetwork/labs/module%201/datasets/githubposting.json" response = requests.get(baseurl) if response.ok: data = response.json() # 2. 转换为DataFrame格式 df = pd.DataFrame(data) # 接口返回的岗位数字段为字符串格式,需先转换为数值类型 df['number_of_positions'] = pd.to_numeric(df['number_of_positions']) # 3. 按技术方向聚合统计岗位数量 # 可自定义要查询的技术方向,示例为Python technology = "Python" number_of_jobs = df.groupby('technology').sum().loc[technology, 'number_of_positions'] print(f"{technology}方向岗位总数:{number_of_jobs}") # 4. 全技术方向岗位统计结果存储到Excel df.groupby('technology').sum().to_excel("github招聘岗位统计.xlsx", engine="openpyxl")
前置依赖安装
运行代码前需要先安装对应的依赖库:
- 安装Pandas:
pip install pandas - 安装Excel读写引擎:
pip install openpyxl
内容的提问来源于stack exchange,提问作者CARLOSLEO280
相关产品推荐
相关产品推荐

