You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何筛选含指定字符串的DataFrame列并保留原始列顺序?

解决DataFrame筛选列并保留原始顺序的问题

当你用df %>% select(contains(c("_time", "___")))时,contains()多参数的逻辑是先提取所有匹配第一个元素的列,再提取匹配第二个元素的列,所以会打乱原始列顺序。要实现筛选且保留原始顺序,可以用以下几种方法:

方法1:使用matches()正则匹配

matches()支持用正则表达式|表示“或”,会按照原始列顺序筛选符合条件的列:

df %>% select(matches("_time|___"))

方法2:先提取符合条件的列名再选择

先通过列名筛选出符合条件的列(保持原始顺序),再用all_of()选中这些列:

# 筛选符合条件的列名
target_cols <- colnames(df)[grepl("_time|___", colnames(df))]
# 选择列
df %>% select(all_of(target_cols))

方法3:使用where()结合列名判断

借助where()和cur_column()来逐个检查列名是否符合条件,同样会保留原始顺序:

df %>% select(where(function(col) {
  grepl("_time", cur_column()) || grepl("___", cur_column())
}))

以上三种方法都能实现仅保留含"time"或"__"的列,同时严格保持原始列的顺序。

内容的提问来源于stack exchange,提问作者user123

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.05 10:01:41