如何比较两个DataFrame字符型列并找出df1独有的唯一字符串
找出仅存在于df1$text中的唯一字符串
数据定义
df1 = data.frame("text" = c("fht49_169_fcxrtvf", "fht49_169_fcxrtvf","fht15_20_trddrefx", "fht15_20_trddrefx", "fht15_18_trddrefx", "fht28_18_ptybrwdf", "fht1_1_tyhfvcs", "fht33_151_tyhfvcs", "fht20_14_gfhyqrsx"), "values_x" = c(3,55,11,3,5,4,8,33,1)) df2 = data.frame("text" = c("fht49_169_fcxrtvf", "fht15_18_trddrefx", "fht28_18_ptybrwdf", "fht33_151_tyhfvcs"), "values_x" = c(3,11,3,5))
df1数据表
| text | values_x |
|---|---|
| fht49_169_fcxrtvf | 3 |
| fht49_169_fcxrtvf | 55 |
| fht15_20_trddrefx | 11 |
| fht15_20_trddrefx | 3 |
| fht15_18_trddrefx | 5 |
| fht28_18_ptybrwdf | 4 |
| fht1_1_tyhfvcs | 8 |
| fht33_151_tyhfvcs | 33 |
| fht20_14_gfhyqrsx | 1 |
df2数据表
| text | values_x |
|---|---|
| fht49_169_fcxrtvf | 3 |
| fht15_18_trddrefx | 11 |
| fht28_18_ptybrwdf | 3 |
| fht33_151_tyhfvcs | 5 |
解决方法
用unique()提取两表text列的唯一值,再通过setdiff()筛选出仅存在于df1中的字符串:
# 计算并保存结果 result <- setdiff(unique(df1$text), unique(df2$text)) # 打印结果 print(result)
运行结果
[1] "fht15_20_trddrefx" "fht1_1_tyhfvcs" "fht20_14_gfhyqrsx"
内容的提问来源于stack exchange,提问作者dede
相关产品推荐
相关产品推荐

