You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python json.loads解析含双引号JSON报分隔符错误如何解决

问题根源

手动拼接JSON字符串的写法存在本质错误:代码中text.replace('"', '\"')没有实现JSON规范要求的双引号转义——Python普通字符串内\"解析后就是普通双引号字符,不会保留转义所需的反斜杠,最终拼接出的字符串里内嵌的双引号直接截断了字段值边界,才会触发分隔符缺失的解析报错。
从你打印的错误输出就能验证问题:生成的JSON片段中"АПК"前后的双引号没有反斜杠转义,解析器会把ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ 识别为text字段的完整值,后续内容不符合JSON语法规则,直接抛出异常。

正确解决方案
  • 首选方案(100%可靠):绝对不要手动拼接JSON字符串,直接使用Python标准库json的序列化方法自动处理所有转义逻辑,双引号、换行、反斜杠、特殊字符都会被自动处理,不会出现转义遗漏问题。
import json

text = "ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ \"АПК\" \"РАССВЕТ\""
# 先构造原生字典,通过dumps生成合法JSON字符串,加ensure_ascii=False避免俄文被转成unicode编码
data = json.dumps({"text": text}, ensure_ascii=False)
print(data)
# 合法输出:{"text": "ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ \"АПК\" \"РАССВЕТ\""}
final_data = json.loads(data)
# 解析无报错,final_data["text"]可以拿到完整原文本
  • 兜底方案(仅用于必须处理已生成的非法JSON的场景,不推荐从源头生成非法内容):如果必须手动拼接,要注意JSON中转义双引号需要保留字面反斜杠,也就是替换双引号时要写成replace('"', '\\"'),Python中双反斜杠才能解析出单个字面反斜杠,最终生成JSON要求的\"转义格式。
text = "ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ \"АПК\" \"РАССВЕТ\""
escaped_text = text.replace('"', '\\"')
data = '{"text": "' + escaped_text + '"}'
final_data = json.loads(data)

注意:兜底手动替换方案仅能处理双引号转义问题,如果文本中包含反斜杠、换行、制表符、Unicode控制字符等其他JSON特殊字符,依然会出现解析错误,没有任何手动替换逻辑能覆盖所有特殊字符场景,使用标准库序列化是唯一稳定可靠的方案。

内容的提问来源于stack exchange,提问作者deepu2711

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.26 11:36:21