Pandas打印多余单元格问题:如何去除Excel读取后的空行空列?
解决Pandas读取Excel时多余空行空列的问题
方法1:读取后清理全空行/列
这是最通用的方案,不管Excel里有没有格式残留都能用:
import pandas as pd # 先读取整个工作表 df = pd.read_excel("你的文件路径.xlsx") # 删除所有全空的行 df = df.dropna(axis=0, how="all") # 删除所有全空的列 df = df.dropna(axis=1, how="all") # 打印处理后的有效数据 print(df)
方法2:读取阶段直接限定范围
如果明确知道有效数据是3列11行,直接在读取时指定范围,效率更高:
import pandas as pd # usecols 指定列范围(比如A到C,可写"A:C"或[0,1,2]),nrows 指定行数 df = pd.read_excel("你的文件路径.xlsx", usecols="A:C", nrows=11) print(df)
方法3:处理带格式的"伪空"单元格
如果Excel里的空单元格有格式(比如背景色、边框),Pandas会把它们当成非空值,先转成真正的空值再过滤:
import pandas as pd df = pd.read_excel("你的文件路径.xlsx") # 把空白字符串、仅含空格的单元格转为NaN df = df.replace(r"^\s*$", pd.NA, regex=True) # 清理全空行和列 df = df.dropna(axis=0, how="all").dropna(axis=1, how="all") print(df)
内容的提问来源于stack exchange,提问作者Eminent Emperor Penguin
相关产品推荐
相关产品推荐

