Python对象ID复用是否会对Pickler造成问题?
关于Pickler实例复用与对象ID的风险问题
首先明确:不存在你担心的错误写入风险,原因如下:
pickle的对象跟踪依赖对象的实际身份(内存中的具体实例),而非
id()返回的数值。哪怕新对象复用了已销毁旧对象的id值,它也是完全独立的新对象,pickler不会把两者混淆——因为pickler内部的memo缓存是用对象本身作为键,而非id数值。长时间持有Pickler实例时,它的memo字典会以强引用的方式保存已序列化的对象。这意味着你“dump后立即丢弃对象”的操作根本无法让对象被GC回收,因为Pickler还持有对象的引用。只有当你调用
pickler.clear_memo()清空缓存,或者销毁Pickler实例时,这些对象才会被回收。就算你手动清空了memo,后续新生成的对象(哪怕id和旧对象重复),pickler也会把它当成全新对象重新序列化,不会错误引用之前写入文件的内容。
补充说明pickle的memo机制:它的核心是避免重复序列化同一对象——比如你多次dump同一个对象实例,只会序列化一次,后续用引用标记。但这里的“同一对象”指的是内存里的同一个实例,和id数值无关。
内容的提问来源于stack exchange,提问作者Philip Couling
相关产品推荐
相关产品推荐

