You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

是否存在覆盖全部256个码位的8-bit代码页(CP-####)?

解决方案

可用编码

你可以直接使用iso-8859-1(别名latin-1)作为encoding参数值,这是标准的8位单字节编码,覆盖全部256个码位,每个字节都有一一对应的Unicode字符,不存在未定义的字节值,完全可以解决你遇到的解码报错问题。

修改后的第9行代码如下:

text_file = open("videointxt", mode="r", encoding="iso-8859-1")

更稳妥的优化方案

因为你的需求本质是读取文件的原始字节并转成二进制字符串,不需要做文本解码,直接以二进制模式读取文件更直接,也能完全避免所有编码相关问题:

  1. 将读取文件的模式改为二进制只读rb,不需要指定encoding参数
  2. 调整二进制字符串生成逻辑,直接遍历读取到的bytes对象的每个字节值即可

修改后的核心代码段:

# 二进制模式打开输入文件,无需指定编码
text_file = open("videointxt", mode="rb")
# 读取全部字节
data = text_file.read()
# 直接遍历字节生成二进制字符串
res = ''.join(format(byte, '08b') for byte in data)

其他代码问题修正

你现有代码末尾的f.close没有加括号,不会实际执行文件关闭操作,建议修改为f.close(),或者使用with上下文管理器自动管理文件开闭,避免资源泄漏。

内容的提问来源于stack exchange,提问作者Eric Ovenden

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.06 04:39:02