You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python读取大JSON文件遇JSONDecodeError错误求助

处理大型JSON文件读取时的JSONDecodeError问题

问题场景

读取大型JSON文件时遇到如下错误:

json.decoder.JSONDecodeError: Expecting ':' delimiter: line 1 column 78175081 (char 78175080)

文件格式示例(片段):

{"[deleted]": {"8gwmc": 1241136488, "8gtzp": 1241116576, "8gogw": 1241098644, "8gwtz": 1241151485, "8emcn": 1240428839, "8h190": 1241184318, "8gmme": 1241066851, "8h1rn": 1241188147,

使用的读取代码:

with open(AP_string, 'r') as AP:
    Astamps = json.load(AP)

该代码可正常读取其他同类文件,已尝试Unicode转义、读取为原始字符串、设置strict=False等方案,均无效。

排查与解决思路

  1. 定位错误位置:
    由于文件过大无法用编辑器打开,可通过代码截取错误位置附近的内容分析:

    error_pos = 78175080  # 报错中的字符位置
    chunk_size = 200  # 获取错误前后各100字符的片段
    
    with open(AP_string, 'rb') as f:
        f.seek(max(0, error_pos - chunk_size//2))
        chunk = f.read(chunk_size).decode('utf-8', errors='replace')
        print(f"错误位置附近内容:\n{chunk}")
    

    这段代码能输出错误点前后的内容,便于排查是否存在引号未闭合、冒号缺失、非法转义字符等语法问题。

  2. 验证文件完整性:
    若截取后未发现明显语法问题,大概率是文件本身损坏(比如传输中断、写入异常导致的文件截断或内容乱码)。可对比文件大小与正常同类文件的差异,或通过哈希校验工具验证文件完整性。

最终结论

后续排查发现文件本身已损坏,这是导致读取报错的根本原因。

内容的提问来源于stack exchange,提问作者toarage

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.23 12:37:05