如何在R语言中获取chicago.csv数据集的最后3列?
在R语言中提取chicago.csv最后3列的方法
步骤1:读取数据集
先将下载好的chicago.csv放到R的工作目录(可通过getwd()查看当前目录,setwd()修改目录),然后读取数据:
chicago_df <- read.csv("chicago.csv")
步骤2:提取最后3列
这里提供几种实用方法:
方法1:通过列索引计算
利用数据框总列数定位最后3列:
# 计算最后3列的索引范围并提取 last_three_cols <- chicago_df[, (ncol(chicago_df) - 2):ncol(chicago_df)]
ncol(chicago_df)返回数据框总列数,减去2得到最后3列的起始索引,再到总列数即可选中目标列。
方法2:通过列名选取
先获取最后3列的列名,再根据列名提取,可读性更强:
# 获取最后3列的列名 last_col_names <- tail(names(chicago_df), 3) # 根据列名提取列 last_three_cols <- chicago_df[, last_col_names]
tail(names(chicago_df), 3)返回列名向量的最后3个元素,用这些名称筛选列,能清晰看到选中的具体列。
方法3:使用dplyr包(tidyverse风格)
若习惯tidyverse工具链,可使用dplyr的select函数:
# 未安装dplyr先执行安装 # install.packages("dplyr") library(dplyr) last_three_cols <- chicago_df %>% select(tail(names(.), 3))
管道符%>%将数据框传递给select函数,配合tail直接选取最后3列,代码简洁流畅。
内容的提问来源于stack exchange,提问作者Phan Thieny
相关产品推荐
相关产品推荐

