Python解码文本文件的正确语法:打开文件输出<_io.TextIOWrapper>如何处理?
Python文件解码及内容读取操作说明
你输出的<_io.TextIOWrapper name='DOB.txt' mode='r+' encoding='cp1252'>是open()函数返回的文件流对象本身,并不是文件内容,需要调用对象的读取方法才能获取文件内的实际内容。
正确操作语法
已知文件编码的场景
打开文件时直接指定对应编码,避免使用系统默认的cp1252编码导致中文等字符乱码:
# 示例中encoding参数替换为你的文件实际编码,常见值为utf-8、gbk、gb2312等 with open("DOB.txt", mode="r+", encoding="utf-8") as file_obj: # 按需选择读取方法: # 1. 读取全部内容,适合小文件 content = file_obj.read() # 2. 逐行读取,适合大文件避免内存占用过高 # for line in file_obj: # print(line) print(content)
未知文件编码的场景
先以二进制模式读取文件字节流,再尝试解码:
with open("DOB.txt", mode="rb") as file_obj: byte_data = file_obj.read() # 按优先级尝试解码 try: content = byte_data.decode("utf-8") except UnicodeDecodeError: try: content = byte_data.decode("gbk") except UnicodeDecodeError: content = byte_data.decode("cp1252", errors="replace") # 无法解码的字符用占位符替换 print(content)
注意事项
- 推荐使用
with语法管理文件流,操作结束后会自动关闭文件,无需手动调用close()方法 - 如果你使用
r+等可读可写模式,读取完成后要执行写入操作时,需要先调用file_obj.seek(0)将文件指针移到目标位置,避免写入位置不符合预期 - 解码时指定
errors="ignore"或errors="replace"可以避免解码失败抛出异常,但可能会丢失部分特殊字符
内容的提问来源于stack exchange,提问作者Christopher
相关产品推荐
相关产品推荐

