pandas运行df[df['col1'] in l]筛选时触发ValueError的原因
报错原因
df['col1'] in l的写法不符合Python和pandas的运算逻辑:
- 原生Python的
in关键字作用是判断单个元素是否存在于可迭代对象中,而df['col1']返回的是整列的Series结构,包含多行数据,不是单个值。 - 用
in判断整个Series是否在列表l中时,pandas无法把多值的Series转换成单个布尔判定结果,就会触发ValueError,常见的配套报错提示为The truth value of a Series is ambiguous。
正确写法
做这类成员判断筛选需要用pandas内置的.isin()方法,该方法会逐元素判断列中每个值是否在目标列表内,返回和原列长度一致的布尔序列,满足DataFrame行筛选的输入要求:
l = ['a', 'b'] df[df['col1'].isin(l)]
内容的提问来源于stack exchange,提问作者Philipp Chapkovski
相关产品推荐
相关产品推荐

