R语言计算data.frame首行与其余行相关性报下标越界错误如何解决
错误原因
- 下标越界的直接原因:你当前运行环境中的
df1行数不足10行,大概率是你构造完df1后又运行了其他修改df1行数的代码,比如取子集、过滤等操作导致行数减少,访问2:10行时超出了实际行数范围。你可以运行dim(df1)查看当前df1的维度,正常构造的df1应该返回[1] 10 10(10行10列)。 - 即使下标不越界,你的代码也无法得到正确的相关系数:
df1第一列Ensembl_ID是字符类型,直接取整行计算时,数值会被强制转换为字符类型,cor函数无法对字符数据计算相关性。你测试用的随机矩阵是纯数值类型,所以不会出现这个问题。
解决方法
首先重新运行你给出的df1构造代码,确保df1是完整的10行10列结构,再用以下两种方法计算:
方法1:将ID列设为行名后计算
# 将第一列ID设为行名,提取纯数值列 rownames(df1) <- df1$Ensembl_ID df_num <- df1[, -1] # 转置后计算第一行与其余行的相关系数 cor_res <- cor(t(df_num[1, ]), t(df_num[-1, ])) # 为结果添加标签方便阅读 colnames(cor_res) <- rownames(df_num)[-1] rownames(cor_res) <- rownames(df_num)[1]
方法2:直接指定数值列计算
如果不想修改原df1的结构,可以直接指定数值列(第2到10列)参与计算:
# 仅提取logFC数值列计算 cor_res <- cor(t(df1[1, 2:10]), t(df1[2:10, 2:10])) # 为结果添加ID标签 colnames(cor_res) <- df1$Ensembl_ID[2:10] rownames(cor_res) <- df1$Ensembl_ID[1]
内容的提问来源于stack exchange,提问作者SUMIT
相关产品推荐
相关产品推荐

