如何在Pandas DataFrame多列中查找特殊字符并筛选含'w'的行?
问题解决方法
问题原因
你当前的代码会将每个不匹配'w'的单元格替换为NaN,而非过滤掉整行,因此结果里出现大量无效的NaN行。要只保留至少有一列包含'w'的完整有效行,需要按行判断是否存在匹配项。
修正后的代码
# 先判断每行是否至少有一列包含'w' has_w = df_test2.apply(lambda x: x.str.contains('w', na=False)).any(axis=1) # 用布尔序列过滤出符合条件的行 df_result = df_test2[has_w] # 查看最终结果 df_result
也可以合并为一行代码:
df_result = df_test2[df_test2.apply(lambda x: x.str.contains('w', na=False)).any(axis=1)]
额外提示
你之前的特殊字符替换操作并未修改原DataFrame,如果要保存替换后的结果,需要赋值回原数据:
df[header] = df[header].apply(lambda x: x.str.replace(pat=r'[^\w]', repl=r'', regex=True))
内容的提问来源于stack exchange,提问作者Joshua Chung
相关产品推荐
相关产品推荐

