R语言如何处理dataframe的Name列,移除ID前缀并拆分提取生成新变量
实现方法
我们可以使用R的tidyverse套件快速完成需求,操作步骤如下:
- 首次使用先安装并加载所需依赖包
install.packages("tidyverse") library(tidyverse)
- 数据处理代码
df_processed <- df %>% mutate( # 移除Name列中与对应ID相同的前缀部分 name_clean = str_remove(Name, fixed(ID)), # 提取处理后Name的最后两位数字 last_two_digit = str_sub(name_clean, -2), # 提取处理后Name的第3位字符 third_char = str_sub(name_clean, 3, 3), # 提取处理后Name的第4位字符 fourth_char = str_sub(name_clean, 4, 4) )
如果不需要保留中间生成的name_clean列,可以在mutate函数的参数中添加.keep = "unused"即可自动移除临时列。
内容的提问来源于stack exchange,提问作者Stataq
相关产品推荐
相关产品推荐

