如何重命名DataFrame中带特定分隔符的列值,删除_数字后的全部内容
你可以直接使用以下代码完成处理:
# 假设你的原DataFrame命名为df df['id'] = df['id'].str.replace(r'_\d.*', '', regex=True)
正则逻辑说明
- 正则表达式
r'_\d.*'中,r表示原生字符串,避免Python转义符和正则转义符冲突 _匹配下划线字面量\d匹配任意0-9的数字.*匹配数字之后出现的所有字符(包括你样例中的/等特殊符号)- 整段匹配到的内容会被替换为空,自然就保留了首个「_加数字」之前的内容,完全符合你的预期输出要求。
内容的提问来源于stack exchange,提问作者user12314164
相关产品推荐
相关产品推荐

