Numpy在Windows和Unix系统下运行相同代码返回结果不一致
测试复现代码
import numpy as np c = [ [1, 2, 3], [4, 5, 6], [7, 8, 9] ] c = np.array(c) print((c * c.transpose()).prod())
同一段代码在不同系统运行结果存在差异:
- Windows平台返回结果:
-1462091776 - Ubuntu平台返回结果:
131681894400
异常产生原因
该现象确实是数值溢出导致,核心诱因是Windows和Linux平台下NumPy默认整数类型的位宽不同:
- Windows环境下,NumPy创建整数数组时默认使用
int32(32位有符号整数)类型,该类型可表示的最大正整数为2^31-1=2147483647。本次运算的正确结果为131681894400,远大于32位有符号整数的上限,连乘过程中数值超出表示范围后会按照补码规则发生截断溢出,最终得到负数结果。 - 64位Ubuntu环境下,NumPy创建整数数组时默认使用
int64(64位有符号整数)类型,该类型可表示的最大正整数为2^63-1=9223372036854775807,远大于本次运算的结果值,不会触发溢出,因此可以返回正确值。
你可以在两个平台分别执行print(c.dtype)验证类型差异,手动指定dtype=np.int64创建数组后,两个平台的运行结果就会完全一致。
是否需要上报Bug、上报渠道说明
该现象不属于需要上报的Bug,是平台特性导致的预期行为:NumPy的默认整数类型位宽和操作系统原生C语言的long类型长度绑定,Windows平台下C语言long类型固定为32位,64位Linux平台下C语言long类型为64位,这个差异是操作系统层面的历史设计,不是NumPy的逻辑错误,也不存在需要修复的代码缺陷。
如果需要规避该跨平台差异,只需要在创建数组时手动指定足够位宽的数据类型即可,不需要走Bug上报流程。
内容的提问来源于stack exchange,提问作者Mr. Enigma
相关产品推荐
相关产品推荐

