使用data.table的like函数筛选数据框行时结果异常求助
问题分析与解决
错误原因
你犯了两个关键错误:
- 操作对象搞反了:你要筛选的是
my_data_1,但代码里却对my_data做索引操作,结果自然返回my_data的所有行。 like函数用法不对:data.table的like(或%like%运算符)需要针对具体列使用,你当前的写法不符合语法规范。
正确实现方法
方法1:用data.table的%like%运算符
先把数据框转成data.table对象,再对my_data_1的col1列做匹配:
library(data.table) my_data = data.frame(col1 = c("abc", "bcd", "bfg") , id = 1:3) my_data_1 = data.frame(col1 = c("abc", "byd", "bgg") , id = 1:3) # 转换为data.table格式 setDT(my_data) setDT(my_data_1) # 筛选目标行 my_data_1[col1 %like% my_data[1, col1]]
输出结果:
col1 id 1: abc 1
方法2:基础R实现(不用data.table)
如果不需要data.table,直接用基础R的精确匹配更高效(毕竟你要的是完全匹配"abc"):
my_data_1[my_data_1$col1 == my_data[1, "col1"], ]
输出同样是:
col1 id 1 abc 1
补充说明
如果是模糊匹配(比如找包含"abc"的字符串),用%like%合适;但精确匹配的话,==更准确也更快,完全贴合你的需求。
内容的提问来源于stack exchange,提问作者stats_noob
相关产品推荐
相关产品推荐

