Python DataFrame列拼接异常问题排查及修正求助
问题排查与代码修正
异常原因
- 循环逻辑错误:你遍历
df1["Cuenta CeCo"].isna()的布尔值时,只要遇到一个空值(x=True),就直接将整列Cuenta CeCo替换为拼接后的结果,导致原本非空的有效数据被全部覆盖,这是异常结果的核心原因。 - 数据类型处理疏漏:
GLAccount是float64类型,直接转字符串会携带.0后缀(比如345会变成"345.0"),不符合预期的拼接格式。
修正代码
推荐使用Pandas的矢量化操作(比循环高效且精准),以下两种方法均可实现需求:
方法一:用loc定位空值行填充
# 先将GLAccount转为整数再转字符串,消除小数点后缀 df1.loc[df1["Cuenta CeCo"].isna(), "Cuenta CeCo"] = df1["GLAccount"].astype(int).astype(str) + " " + df1["CeCoCeBe"]
方法二:用fillna方法直接填充空值
# 先构造用于填充的Series fill_values = df1["GLAccount"].astype(int).astype(str) + " " + df1["CeCoCeBe"] # 仅对空值位置进行填充 df1["Cuenta CeCo"] = df1["Cuenta CeCo"].fillna(fill_values)
验证结果
执行修正后的代码后,DataFrame会输出预期结果:
Cuenta CeCo GLAccount CeCoCeBe 0 123 A 123.0 A 1 234 S 234.0 S 2 345 B 345.0 B 3 987 A 987.0 A
内容的提问来源于stack exchange,提问作者Cami
相关产品推荐
相关产品推荐

