R语言中mean()函数为何可计算累积分布函数CDF的概率
R语言mean()函数计算累积分布概率的原理
- R中逻辑值
TRUE和FALSE在参与数值运算时,会被自动强制转换为数值1和0。你执行x <= a时会返回和男性身高向量x长度一致的逻辑向量:身高小于等于a的位置为TRUE,其余位置为FALSE。 mean()的本质是对输入向量的所有元素求算术平均,计算逻辑为「向量元素总和 / 向量总长度」。代入当前场景后:- 逻辑向量的求和结果就是身高小于等于a的样本总个数
- 除以总样本数后得到的就是样本中身高≤a的个体占比,这个占比对应频率派的概率定义:大量重复抽样下事件发生的频率趋近于事件发生的概率,也就是你要的累积分布函数在
a点的取值。
你运行
CDF(70)得到0.623,就意味着当前提取的男性身高样本里,有62.3%的人身高≤70(默认单位为英寸),完全符合累积分布函数「随机变量取值小于等于某一实数的概率」的定义,所以这个自定义函数就是对应当前样本的经验累积分布函数。
内容的提问来源于stack exchange,提问作者Hyun Sung Lee
相关产品推荐
相关产品推荐

