Python如何删除pandas DataFrame中title列前缀'new'并解决ValueError报错
报错原因
你代码里的if判断直接对两个pandas Series/DataFrame做等值比较,返回的是同样长度的布尔序列,pandas无法将序列直接转换为单个布尔值供给if判断逻辑,所以抛出了歧义错误。另外你写的indeed['title'].str[3:]没有赋值回原列,就算判断逻辑跑通也不会实际修改数据。
正确解决方案
最简单的实现方式是用正则匹配替换开头的new前缀,不会误删内容中间出现的new字符:
indeed['title'] = indeed['title'].str.replace(r'^new', '', regex=True)
如果希望更稳妥,不想用正则,也可以用条件分片的写法:
# 筛选所有以new开头的行,na=False用于处理列中空值,避免后续操作报错 mask = indeed['title'].str.startswith('new', na=False) # 仅对符合条件的行去掉前3个字符,其余行保持不变 indeed.loc[mask, 'title'] = indeed.loc[mask, 'title'].str[3:]
内容的提问来源于stack exchange,提问作者imicron3
相关产品推荐
相关产品推荐

