使用dplyr的count()统计字符串型ID时遇方法不适用错误求助
分组统计唯一字符串值数量的问题解决
你完全可以统计分组中出现的唯一字符串值的数量,代码报错是因为用错了函数。
错误原因
count()是dplyr中针对数据框(或分组数据框)做分组计数的函数,不能直接在summarize()里传入单个字符列调用,这就导致了报错提示的"no applicable method for 'count' applied to an object of class 'character'"问题。
修正后的代码
pt_agg_df <- filtered_df() %>% group_by(AE_AS_PREFERRED_TERM) %>% summarize(case_count = n_distinct(SAPPHIRE_CASE_ID_VERSION)) %>% arrange(-case_count)
说明
n_distinct()是dplyr专门用来计算向量中唯一值数量的函数,刚好匹配你统计每组唯一案例ID数量的需求。
内容的提问来源于stack exchange,提问作者smackenzie
相关产品推荐
相关产品推荐

