如何从列名列表获取pandas DataFrame首个存在列,无匹配返回None
最优实现方案
直接利用Python内置next()函数的第二个默认返回参数,修改原有代码即可,写法最简洁,不需要额外引入其他逻辑:
# 仅需添加第二个参数 None,无匹配时直接返回 None 不抛错 col = next(filter(lambda c: c in df, cols), None)
效果说明
- 完全保留原有匹配逻辑:按
cols传入的顺序校验列是否存在,返回第一个匹配到的列名 - 无任何匹配列时直接返回
None,无需手动捕获StopIteration异常 - 拿到列名后可直接判断取值:
# 取对应列的Series,无匹配时返回None target_col = df[col] if col is not None else None # Python3.8+ 可使用海象运算符合并为一行 target_col = df[col] if (col := next(filter(lambda c: c in df, cols), None)) is not None else None
注意事项
不要使用set(cols) & set(df.columns)的集合交集方案,集合为无序结构,会丢失cols列表的优先级顺序,无法保证返回第一个匹配的列,不符合需求。
内容的提问来源于stack exchange,提问作者Janosh
相关产品推荐
相关产品推荐

