R语言数据处理:i列值大于i-1列时拆分单行数据为多行
单行递减序列拆分实现方案
问题规则
需要将单行存储的长数值序列拆分为多行,满足:
- 每行内数值严格递减,即任意位置数值大于下一个位置数值
- 遍历序列时,若当前数值大于等于前一个数值,就在当前位置前拆分新行
示例数据
# 示例数据格式与真实数据一致 df <- data.frame(matrix(ncol = 9, nrow = 1)) df[1,] <- c(3, 2, 1, 2, 1, 1, 3, 2, 1)
对应期望输出:
3 2 1 2 1 1 3 2 1
基础R实现(无第三方依赖)
直接将单行数据转为向量处理,比逐列操作数据框效率更高,适合大数值量场景:
# 提取单行数值为向量 num_vec <- as.numeric(df[1, ]) # 生成分组标识:序列中断时组号递增 group_id <- c(1, cumsum(num_vec[-1] >= num_vec[-length(num_vec)]) + 1) # 按组拆分序列 split_result <- split(num_vec, group_id) # 打印为期望的文本格式 for (row in split_result) { cat(paste(row, collapse = " "), "\n") }
运行输出:
3 2 1 2 1 1 3 2 1
如果需要将拆分结果转为标准数据框结构(短行用NA补齐长度),可以追加以下代码:
max_row_length <- max(lengths(split_result)) result_df <- as.data.frame( t(sapply(split_result, function(r) c(r, rep(NA, max_row_length - length(r))))) )
实现逻辑说明
- 第一个值默认归属第1组
- 从第二个值开始,只要出现当前值大于等于前一个值的情况,就代表严格递减的序列中断,需要开启新行,组号对应加1
- 用向量运算代替逐行if判断循环,处理十万级以上数值量时也能保持较快速度
- 判断条件使用
>=而非>,匹配示例中相邻相等数值也需要拆分的规则
内容的提问来源于stack exchange,提问作者Alinnaeus
相关产品推荐
相关产品推荐

