You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Pandas用正则命名组提取列时报KeyError:'Suburb'不在索引中

报错原因

  • 未赋值:你运行的str.extract代码仅返回了临时的提取结果,没有将新增的两列写入原DataFrame,原df本身不存在Suburb字段,直接调用自然触发KeyError
  • 正则匹配错误:你写的正则表达式存在语法问题:方括号[]内的+?|会被识别为普通字面量而非正则语法,无法匹配你给出的所有地址格式,部分行匹配失败会导致捕获组缺失,也会引发索引异常。

修复方案

你的示例数据中地址和郊区明确用逗号分隔,直接用更简单的正则匹配即可,同时记得将提取结果赋值给原DataFrame:

df[["Address", "Suburb"]] = (df["Address Column"]
    .str.extract(r"(?P<Address>.*?),\s*(?P<Suburb>.*)$")
    .apply(lambda x: x.str.strip().str.title())
)

新增的.str.strip()用来处理部分郊区字段前后多余的空格,最终输出和你期望的结果完全一致。

验证方法

你可以先单独运行提取逻辑确认结果符合预期,再做赋值操作:

# 单独查看提取结果
extract_result = (df["Address Column"]
    .str.extract(r"(?P<Address>.*?),\s*(?P<Suburb>.*)$")
    .apply(lambda x: x.str.strip().str.title())
)
# 确认列名存在
print(extract_result.columns)
# 查看完整提取内容
print(extract_result)

内容的提问来源于stack exchange,提问作者adey27

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.04 01:30:00