You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

R语言拆分数据框指定列时如何保留原有列数据?

解决R语言拆分数据框列时保留原有列数据的问题

你的原始数据框如下:

df <- data.frame(
  R1 = c("10 EFTA : 0 / BAA/GBR : 0 / ES : 2", "10","0"),
  R2 = c("-", "EFTA : 0 / BAA/GBR : 0 / ES : 2","18")
)

你之前用df[c('R1', 'R2')] <- str_split_fixed(df$R1, ' ', 2)的问题在于:str_split_fixed会对所有行的R1执行拆分,后面两行的R1无空格,拆分后的第二列是空字符串,直接替换会覆盖掉R2列原本的有效数据。

要实现只拆分R1中包含空格的行,同时保留其他行的R2原始数据,可以用以下两种方法:

方法一:基础R实现

先加载stringr包(str_split_fixed来自这个包),通过条件判断只更新需要拆分的行:

library(stringr)

# 对所有R1行执行拆分,得到两列临时数据
split_result <- str_split_fixed(df$R1, " ", 2)

# 仅当拆分后的第二列不为空时,更新R1和R2;否则保留原有值
df$R1 <- ifelse(split_result[, 2] != "", split_result[, 1], df$R1)
df$R2 <- ifelse(split_result[, 2] != "", split_result[, 2], df$R2)

执行后得到的目标数据框:

> df
  R1                                      R2
1 10 EFTA : 0 / BAA/GBR : 0 / ES : 2
2 10 EFTA : 0 / BAA/GBR : 0 / ES : 2
3  0                                     18

方法二:dplyr管道式实现

如果你习惯用dplyr的语法,可采用更清晰的管道写法:

library(dplyr)
library(stringr)

df <- df %>%
  mutate(
    # 拆分R1为列表,仅拆前2部分
    split_list = str_split(R1, " ", n = 2),
    # 对拆分后有2个元素的行,更新R1为第一个元素,否则保留原R1
    R1 = case_when(
      lengths(split_list) == 2 ~ map_chr(split_list, 1),
      TRUE ~ R1
    ),
    # 同理,更新R2为拆分后的第二个元素,否则保留原R2
    R2 = case_when(
      lengths(split_list) == 2 ~ map_chr(split_list, 2),
      TRUE ~ R2
    )
  ) %>%
  # 移除临时生成的split_list列
  select(-split_list)

内容的提问来源于stack exchange,提问作者silent_hunter

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.09 03:22:24