如何用Python拆分特定格式字符列表并转换为DataFrame?
解决方法
步骤说明
- 先对列表中的每个元素做清洗:去除首尾的换行符与空白,再按换行符
\n分割成单独字段 - 提取第一个元素的结果作为DataFrame的列标题
- 剩余元素的结果作为数据行,传入pandas构造DataFrame
代码实现
import pandas as pd # 爬取得到的原始数据列表 raw_data = ['\nYear\nMonth\nValue\n', '\n2023\nAugust\n(p) 164.06\n', '\n2023\nJuly\n(sf) (r) 148.02\n'] # 清洗并拆分每个元素 cleaned_data = [item.strip().split('\n') for item in raw_data] # 拆分表头和数据 columns = cleaned_data[0] rows = cleaned_data[1:] # 转换为DataFrame result_df = pd.DataFrame(rows, columns=columns) # 查看结果 print(result_df)
转换后的表格效果
| Year | Month | Value |
|---|---|---|
| 2023 | August | (p) 164.06 |
| 2023 | July | (sf) (r) 148.02 |
内容的提问来源于stack exchange,提问作者encore10
相关产品推荐
相关产品推荐

