如何在R的pivot_longer函数中用正则匹配drink开头day1结尾的列
解决pivot_longer中筛选特定列的正则表达式问题
要匹配以drink开头且以day1结尾的列,你需要把开头和结尾的规则用匹配任意中间内容的表达式连接起来,最终的正则表达式是:^drink.*day1$
正则表达式各部分说明:
^drink:限定列名必须以drink开头.*:匹配任意数量的任意字符(包括下划线、数字等),用来覆盖开头和结尾之间的所有内容day1$:限定列名必须以day1结尾
完整R代码示例:
library(tidyr) # 构造示例数据框 df <- data.frame( drink_type_1_day1 = c(1, 2), drink_vol_1_day1 = c(3, 4), drink_type_1_day2 = c(5, 6), drink_vol_1_day2 = c(7, 8), non_target_col = c(9, 10) ) # 执行pivot_longer筛选目标列 df_long <- df %>% pivot_longer( cols = matches("^drink.*day1$"), names_to = "drink_detail", values_to = "measurement" )
这段代码会精准提取drink_type_1_day1和drink_vol_1_day1两列,将其转换为长格式数据。
内容的提问来源于stack exchange,提问作者GJW
相关产品推荐
相关产品推荐

