如何将带有HTML编码的字符串转换为对应符号的普通字符串
HTML实体编码转原始字符解决方案
首先明确:你遇到的`这类序列属于HTML十进制实体编码,兼容ISO 8859-1字符集,完成HTML实体解码即可得到对应原始字符,修复后的链接可正常访问。
以下是不同开发场景下的实现方法:
Python 处理
直接调用Python内置的html模块即可完成解码,无需额外安装依赖:
import html import json # 处理整段JSON字符串(推荐在JSON解析前执行) raw_json = "你的原始JSON字符串" decoded_json = html.unescape(raw_json) data = json.loads(decoded_json) # 单独处理单个链接 raw_url = "externalApiPath/live/userfiles/Image/img_CS FSTD(H).300 AMC1 cont`d_1.PNG" fixed_url = html.unescape(raw_url) # 输出结果:externalApiPath/live/userfiles/Image/img_CS FSTD(H).300 AMC1 cont`d_1.PNG
JavaScript 处理
前端场景下可以用原生DOM API实现解码:
function htmlDecode(input) { return new DOMParser().parseFromString(input, "text/html").documentElement.textContent; } const rawUrl = "externalApiPath/live/userfiles/Image/img_CS FSTD(H).300 AMC1 cont`d_1.PNG"; const fixedUrl = htmlDecode(rawUrl);
Java 处理
使用Apache Commons Text工具类实现:
import org.apache.commons.text.StringEscapeUtils; String rawUrl = "externalApiPath/live/userfiles/Image/img_CS FSTD(H).300 AMC1 cont`d_1.PNG"; String fixedUrl = StringEscapeUtils.unescapeHtml4(rawUrl);
注意事项
- 优先对完整的原始JSON字符串执行解码,再进行JSON解析,无需遍历每个字段,也不会破坏JSON结构。
- 批量处理本地JSON文件时,可写脚本遍历所有文件执行解码操作后重新保存即可。
内容的提问来源于stack exchange,提问作者Denis Kaminsky
相关产品推荐
相关产品推荐

