You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Pandas读取Excel时'NA'被转为NaN的问题及解决方法

问题与解决办法

问题情况

  • 原始Excel表格中包含字符串NA
  • 使用以下代码合并多个Excel文件:
from pathlib import Path

import pandas as pd
p = Path(r'/.')
df = pd.concat([pd.read_excel(f) 
                for f in p.rglob('test.xlsx')],
               ignore_index=True)
df
df.to_excel("final.xlsx")
  • 出现的问题:
    • 合并后的DataFrame中,原始的字符串NA被转换为NaN
    • 将DataFrame导出为Excel后,原本的NA字符串位置变成空白

解决办法

在读取Excel文件时,设置参数keep_default_na=False(关闭pandas默认将NA识别为缺失值的行为)。修改后的代码如下:

from pathlib import Path

import pandas as pd
p = Path(r'/.')
df = pd.concat([pd.read_excel(f, keep_default_na=False) 
                for f in p.rglob('test.xlsx')],
               ignore_index=True)
df.to_excel("final.xlsx")

内容的提问来源于stack exchange,提问作者Siddharth Chavan

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.24 15:36:08