You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Python DataFrame中处理字符串列:提取后缀并按分隔符数加空格

处理DataFrame字符串:提取后缀并添加对应空格前缀

问题场景

给定如下DataFrame:

import pandas as pd
df = pd.DataFrame({'tekstkolonne': ['sten','sten\\kim\\rene', 'sten\\kim\\camilla\\jens']})

需要完成两个操作:

  1. 统计每个字符串中\的数量
  2. 移除最后一个\之前的所有内容,并在结果前添加与\数量相等的空格,最终得到:
df = pd.DataFrame({'tekstkolonne': ['sten','  rene', '   jens']})

解决方案

通过pandas的apply方法结合字符串操作即可实现,代码如下:

import pandas as pd

# 原始数据(注意Python中\需转义为\\)
df = pd.DataFrame({'tekstkolonne': ['sten','sten\\kim\\rene', 'sten\\kim\\camilla\\jens']})

# 批量处理字符串
df['tekstkolonne'] = df['tekstkolonne'].apply(lambda x: 
    ' ' * x.count('\\') + x.rsplit('\\', 1)[-1] if '\\' in x else x
)

代码解释

  • x.count('\\'):统计当前字符串中反斜杠的数量,用于生成对应个数的空格前缀
  • x.rsplit('\\', 1)[-1]:从字符串右侧按反斜杠分割1次,取最后一段(即最后一个反斜杠后的内容)
  • 条件判断:如果字符串中没有反斜杠,直接保留原内容;否则拼接空格前缀和提取的后缀内容

验证结果

执行代码后,输出的DataFrame完全符合需求:

tekstkolonne
0         sten
1        rene
2       jens

内容的提问来源于stack exchange,提问作者Sten B. Rasmussen

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.22 18:33:20