Python json.loads解析含双引号JSON报分隔符错误如何解决
问题根源
手动拼接JSON字符串的写法存在本质错误:代码中text.replace('"', '\"')没有实现JSON规范要求的双引号转义——Python普通字符串内\"解析后就是普通双引号字符,不会保留转义所需的反斜杠,最终拼接出的字符串里内嵌的双引号直接截断了字段值边界,才会触发分隔符缺失的解析报错。
从你打印的错误输出就能验证问题:生成的JSON片段中"АПК"前后的双引号没有反斜杠转义,解析器会把ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ 识别为text字段的完整值,后续内容不符合JSON语法规则,直接抛出异常。
正确解决方案
- 首选方案(100%可靠):绝对不要手动拼接JSON字符串,直接使用Python标准库
json的序列化方法自动处理所有转义逻辑,双引号、换行、反斜杠、特殊字符都会被自动处理,不会出现转义遗漏问题。
import json text = "ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ \"АПК\" \"РАССВЕТ\"" # 先构造原生字典,通过dumps生成合法JSON字符串,加ensure_ascii=False避免俄文被转成unicode编码 data = json.dumps({"text": text}, ensure_ascii=False) print(data) # 合法输出:{"text": "ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ \"АПК\" \"РАССВЕТ\""} final_data = json.loads(data) # 解析无报错,final_data["text"]可以拿到完整原文本
- 兜底方案(仅用于必须处理已生成的非法JSON的场景,不推荐从源头生成非法内容):如果必须手动拼接,要注意JSON中转义双引号需要保留字面反斜杠,也就是替换双引号时要写成
replace('"', '\\"'),Python中双反斜杠才能解析出单个字面反斜杠,最终生成JSON要求的\"转义格式。
text = "ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ \"АПК\" \"РАССВЕТ\"" escaped_text = text.replace('"', '\\"') data = '{"text": "' + escaped_text + '"}' final_data = json.loads(data)
注意:兜底手动替换方案仅能处理双引号转义问题,如果文本中包含反斜杠、换行、制表符、Unicode控制字符等其他JSON特殊字符,依然会出现解析错误,没有任何手动替换逻辑能覆盖所有特殊字符场景,使用标准库序列化是唯一稳定可靠的方案。
内容的提问来源于stack exchange,提问作者deepu2711
相关产品推荐
相关产品推荐

