Python中os.stat获取的st_ino写入文件后值异常变更问题
问题分析与解决
核心原因
- Excel的数值精度限制:你写入xlsx时遇到的重复inode编号问题,本质是Excel默认存储机制导致的。Excel用双精度浮点数存储数值,这种格式只能精确表示小于
2^53的整数。Linux的inode编号是64位无符号整数,一旦超过2^53,直接写入Excel会被舍入近似,看起来就像重复值;转成字符串后,Excel会以文本格式保存,完整保留inode编号。 - 序列化工具的整数兼容问题:用shelve存储时的数据不一致,是因为shelve底层的存储/序列化后端(比如dbm)对64位无符号整数的支持有缺陷。Python自身的
int能处理任意大整数,但部分底层库会把它转成有符号整数处理,导致溢出或值变更;转成字符串就绕开了数值类型转换的坑,直接存文本就没问题。 - 控制台打印正常是因为Python本身能正确处理大整数,不会有精度丢失或类型转换错误。
处理建议
- 写入Excel时:如果想保留数值类型,要把单元格格式设为文本(比如用
openpyxl时指定cell.number_format = '@');嫌麻烦直接转字符串写入最稳妥。 - 使用shelve时:要么转字符串存储,要么换用纯
pickle序列化存储(避免dbm后端的限制);如果一定要存数值,确认下shelve用的后端(比如dbm.gnu)是否支持大整数。 - 不是必须转字符串,但转字符串是最省心的方式,能避开各类存储/序列化库的数值类型兼容问题。
内容的提问来源于stack exchange,提问作者user2328273
相关产品推荐
相关产品推荐

