You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

R语言如何处理dataframe的Name列,移除ID前缀并拆分提取生成新变量

实现方法

我们可以使用R的tidyverse套件快速完成需求,操作步骤如下:

  1. 首次使用先安装并加载所需依赖包
install.packages("tidyverse")
library(tidyverse)
  1. 数据处理代码
df_processed <- df %>%
  mutate(
    # 移除Name列中与对应ID相同的前缀部分
    name_clean = str_remove(Name, fixed(ID)),
    # 提取处理后Name的最后两位数字
    last_two_digit = str_sub(name_clean, -2),
    # 提取处理后Name的第3位字符
    third_char = str_sub(name_clean, 3, 3),
    # 提取处理后Name的第4位字符
    fourth_char = str_sub(name_clean, 4, 4)
  )

如果不需要保留中间生成的name_clean列,可以在mutate函数的参数中添加.keep = "unused"即可自动移除临时列。

内容的提问来源于stack exchange,提问作者Stataq

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.29 21:06:02