Python读取文本文件时如何保留空行?
保留空行读取文本文件的解决方案
原生Python(最可靠)
直接用内置文件读取功能逐行读取,完全保留所有行(包括空行):
with open('你的文件路径.txt', 'r', encoding='utf-8-sig') as f: # rstrip('\n')只移除换行符,空行处理后会变成空字符串'' lines = [line.rstrip('\n') for line in f]
得到的lines是一个列表,空行对应空字符串,后续可转成numpy数组:
import numpy as np lines_array = np.array(lines)
为什么numpy.genfromtxt不行?
genfromtxt的设计目标是读取结构化数据,默认会跳过空行,即使设置delimiter="none"也无法改变这个逻辑——它会把空行判定为无效数据行直接过滤,所以不适合用来保留空行的场景。
用Pandas实现
如果一定要用Pandas,需设置skip_blank_lines=False,同时指定一个文件中不存在的分隔符,确保每行被当作单个字段读取:
import pandas as pd # 用\x01(ASCII SOH字符)作为分隔符,几乎不会出现在普通文本里 df = pd.read_csv( '你的文件路径.txt', sep='\x01', encoding='utf-8-sig', header=None, # 无表头 skip_blank_lines=False ) # 提取所有行到列表或numpy数组 lines_list = df[0].tolist() lines_array = df[0].to_numpy()
内容的提问来源于stack exchange,提问作者MinimalCodingIQ
相关产品推荐
相关产品推荐

