You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何将带有HTML编码的字符串转换为对应符号的普通字符串

HTML实体编码转原始字符解决方案

首先明确:你遇到的`这类序列属于HTML十进制实体编码,兼容ISO 8859-1字符集,完成HTML实体解码即可得到对应原始字符,修复后的链接可正常访问。

以下是不同开发场景下的实现方法:

Python 处理

直接调用Python内置的html模块即可完成解码,无需额外安装依赖:

import html
import json

# 处理整段JSON字符串(推荐在JSON解析前执行)
raw_json = "你的原始JSON字符串"
decoded_json = html.unescape(raw_json)
data = json.loads(decoded_json)

# 单独处理单个链接
raw_url = "externalApiPath/live/userfiles/Image/img_CS FSTD(H).300 AMC1 cont`d_1.PNG"
fixed_url = html.unescape(raw_url)
# 输出结果:externalApiPath/live/userfiles/Image/img_CS FSTD(H).300 AMC1 cont`d_1.PNG

JavaScript 处理

前端场景下可以用原生DOM API实现解码:

function htmlDecode(input) {
  return new DOMParser().parseFromString(input, "text/html").documentElement.textContent;
}

const rawUrl = "externalApiPath/live/userfiles/Image/img_CS FSTD(H).300 AMC1 cont`d_1.PNG";
const fixedUrl = htmlDecode(rawUrl);

Java 处理

使用Apache Commons Text工具类实现:

import org.apache.commons.text.StringEscapeUtils;

String rawUrl = "externalApiPath/live/userfiles/Image/img_CS FSTD(H).300 AMC1 cont`d_1.PNG";
String fixedUrl = StringEscapeUtils.unescapeHtml4(rawUrl);

注意事项

  • 优先对完整的原始JSON字符串执行解码,再进行JSON解析,无需遍历每个字段,也不会破坏JSON结构。
  • 批量处理本地JSON文件时,可写脚本遍历所有文件执行解码操作后重新保存即可。

内容的提问来源于stack exchange,提问作者Denis Kaminsky

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.27 19:06:04