You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在DataFrame列的所有数据中间添加下划线‘_’

解决方法

你的代码失效是因为直接对DataFrame做行切片(df[:4]取前4行、df[2:]取第3行及以后),不是针对每个单元格的字符串做切片处理。针对目标列的季度字符串格式转换,有几种实用方法:

  • 字符串切片法(最直接)
    假设原数据列名为period,通过str属性访问字符串操作方法,分别截取年份和季度部分再拼接:

    df['quarter'] = df['period'].str[:4] + '_' + df['period'].str[4:]
    

    比如对2008Q1,str[:4]取2008,str[4:]取Q1,拼接后得到2008_Q1。

  • 正则替换法(更灵活)
    用正则匹配年份和季度的结构,替换为带下划线的格式,适配更多类似格式:

    df['quarter'] = df['period'].str.replace(r'(\d{4})(Q\d)', r'\1_\2')
    

    正则(\d{4})匹配4位年份,(Q\d)匹配季度标识,\1和\2分别引用这两个分组,中间加下划线拼接。

  • 日期转换法(附带格式验证)
    如果你的季度字符串是标准日期格式,可以先转为datetime类型,再格式化输出:

    import pandas as pd
    df['quarter'] = pd.to_datetime(df['period']).dt.strftime('%Y_Q%q')
    

    这种方法会自动验证输入格式的合法性,非法值会转为NaT方便后续处理。

内容的提问来源于stack exchange,提问作者Entertainment 001

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.14 11:30:56