如何解读R中prop.test针对2组以上数据的估计比例输出
R语言
prop.test输出结果解读 prop 1~prop 4的含义
prop.test接收2列矩阵作为输入时,默认规则为:
- 矩阵第一列为每组的成功次数,第二列为每组的失败次数
- 每一行对应一个独立的受试组别
你输出的prop 1到prop 4分别对应四行(按icecream、pancakes、pizza、burger顺序)的第一列数值 / 该行两列数值总和,对应计算如下:
- prop 1:icecream行的
11/(11+23) ≈ 0.3235 - prop 2:pancakes行的
14/(14+12) ≈ 0.5385 - prop 3:pizza行的
25/(25+42) ≈ 0.3731 - prop 4:burger行的
34/(34+23) ≈ 0.5965
这个数值和两组数据的重叠率、预测准确率没有任何关系,只是对应行第一列值占该行总和的占比。如果你原本的a、b两列不是同一组试验的成功、失败计数,那你当前使用prop.test的场景本身不符合函数设计逻辑,结果没有实际业务意义。
调换列顺序后结果变化的原因
你将列顺序调换为cbind(b,a)后,矩阵第一列变成了b列,此时prop的计算规则变成对应行b值 / 该行两列总和,因此输出的样本占比估计值会全部变化,本质是计算占比的分子从a变成了b。
注意此时卡方值、p值通常不会改变:因为调换两列相当于把所有组的占比换成1-原占比,组间的占比差异程度没有变化,检验的显著性不会受到影响。
内容的提问来源于stack exchange,提问作者caffeinated goose
相关产品推荐
相关产品推荐

