Pandas读取日志文件时首行无索引显示且行数统计异常的问题求助
Pandas读取日志文件时首行无索引显示且行数统计异常的问题求助
我遇到了一个Pandas读取日志文件的棘手问题,想请教各位帮忙分析下:
我有一个包含18行表头的大型文本日志文件,一开始我尝试直接读取并打印整个DataFrame:
df = pd.read_csv('my_log') print(df)
结果直接触发了解析错误:
pandas.errors.ParserError: Error tokenizing data. C error: Expected 1 fields in line 19, saw 3
之后我尝试跳过前18行表头,改用下面的代码读取:
df = pd.read_csv('my_log', header=18)
这时候打印DataFrame的话,会先显示原文件的第19行(这行没有任何索引编号),然后才是从索引0开始的内容。而且不管我用print(df.loc[[0]])指定哪个索引行,都会先跳出那行无索引的内容,再显示我实际想要的行。
我已经检查过文本文件的格式,每一行都是以CR/LF结尾的;甚至把原文件的第19行完全删掉,问题还是一模一样。更奇怪的是,就算我把所有表头都删掉再读取整个DataFrame,依然会出现同样的异常:第一行无索引显示,而且DataFrame统计的行数比实际文件的行数少1。
有没有大佬能给点解决建议呀?非常感谢!
备注:内容来源于stack exchange,提问作者yodish
相关产品推荐
相关产品推荐

