为什么R语言中两次调用rep()函数生成的向量长度不同?
R语言两段rep()代码输出长度不一致的原因
核心原因:浮点数精度误差+rep()的截断取整规则
- R的
rep()函数接收times参数时,如果传入值为非整数,会默认执行截断取整(向零取整),仅保留整数部分参与重复次数计算。 - 十进制的0.55、0.05属于无法被二进制浮点数精确存储的数值,因此
1 - 0.55的实际计算结果略小于理论值0.45,1 - 0.05的实际计算结果略小于理论值0.95。
两段代码的具体计算差异
代码1的times向量计算
500 * c(.55, .45, .05, .95)的计算结果分别为精确的275、225、25、475,取整后求和:
275 + 225 + 25 + 475 = 1000
因此输出长度为1000。
代码2的times向量计算
500 * c(.55, 1-.55, .05, 1-.05)中,500*(1-0.55)的实际值略小于225,截断取整后为224,其余三个值取整后仍为275、25、475,求和:
275 + 224 + 25 + 475 = 999
因此输出长度为999。
你可以在R中运行以下代码验证浮点数差异:print(c(0.45, 1-0.55), digits = 20)
内容的提问来源于stack exchange,提问作者Eric Green
相关产品推荐
相关产品推荐

