批量导入文本文件至Pandas DataFrame时遭遇ParserError问题
问题:多文本文件导入DataFrame时触发解析错误
此前相关问题已有诸多讨论,但现有解决方案均不适用。我尝试将文件夹中的所有文本文件导入DataFrame:当文件夹中仅含1个文件时代码可正常运行,添加另一个文件后则触发错误:
ParserError: Error tokenizing data. C error: Expected 1 fields in line 40, saw 2
我先后尝试以下两种代码实现,均得到相同报错结果:
尝试代码1
import pandas as pd import os import glob # 定义存放文本文件的文件夹路径 files_folder = "/data/TB/WA_dirty_prep_reports/" files = [] # 通过列表推导式创建DataFrame列表 files = [pd.read_csv(file) for file in glob.glob(os.path.join(files_folder,"*txt"))] # 将多个DataFrame合并为一个 files_df = pd.concat(files) print(files_df)
尝试代码2
import glob import pandas as pd path = '/data/TB/WA_dirty_prep_reports' summary_files = glob.glob(path + "/*.txt") df_list = [] df_list = (pd.read_csv(file) for file in summary_files) big_df = pd.concat(df_list, ignore_index=True)
内容的提问来源于stack exchange,提问作者natural_d
相关产品推荐
相关产品推荐

