You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用separate函数分离字符串中的字符与数字?

分离字符串中的字母与数字部分

你可以通过指定正则分隔符或使用extract函数实现字母与数字的拆分,以下是两种可行方案:

方案1:修改separate的分隔符参数

原代码中separate未指定正确的拆分位置,导致无法区分字母和数字。使用正则表达式的正向预查匹配字母与数字的边界,以此作为拆分点:

library(tidyverse)
dd = data.frame(xx=c("sdsds1234","ddd252","rrr34566"))

dd %>% 
  separate(col = xx, remove = FALSE, into = c("Name", "MedID"), 
           sep = "(?<=[A-Za-z])(?=[0-9])")

运行结果:

xx   Name MedID
1 sdsds1234 sdsds  1234
2    ddd252   ddd   252
3  rrr34566   rrr 34566

方案2:使用extract提取分组内容

extract函数专门用于从字符串中提取正则匹配的分组内容,更适配这种固定格式的拆分场景:

dd %>% 
  extract(col = xx, into = c("Name", "MedID"), 
          regex = "([A-Za-z]+)([0-9]+)", remove = FALSE)

正则规则说明:

  • ([A-Za-z]+) 匹配连续字母序列,对应Name列
  • ([0-9]+) 匹配连续数字序列,对应MedID列

两种方案都能得到目标拆分结果,可根据使用习惯选择。

内容的提问来源于stack exchange,提问作者Z. Zhang

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.22 22:54:59