如何将指定格式的TXT文件转换为pandas DataFrame
解决方法
从你提供的截图来看,该TXT是带表头、字段以空白字符(空格/制表符)分隔的结构化文本,直接用pandas内置方法即可快速读取为DataFrame:
- 常规空白分隔TXT直接用
read_table,默认适配任意数量的空白分隔符、自动识别首行作为表头:
import pandas as pd # 替换为你的本地文件路径 df = pd.read_table("./your_file.txt")
如果读取后格式不符合预期,可以按需加参数调整:
- 需跳过文件前N行无效内容:添加
skiprows=N,例如skiprows=1即跳过首行 - 文件无自带表头:添加
names=["列名1", "列名2", "列名3"]手动指定列名 - 为固定宽度对齐的文本:改用
read_fwf方法读取精度更高:
df = pd.read_fwf("./your_file.txt")
读取完成后执行print(df.head())即可验证前5行数据格式是否正确。
内容的提问来源于stack exchange,提问作者Roy
相关产品推荐
相关产品推荐

