Python编码解码:文本中转义字符转对应符号失败求助
解决方案
你遇到的问题是编码不匹配:字符串中的\xd1是字符Ñ的ISO-8859-1(又称Latin-1)编码值,而你用UTF-8解码无法正确解析——因为UTF-8对Ñ的编码是\xc3\x91,两者不兼容。
替换成以下解码方式即可得到预期结果:
(response.content).decode('ISO-8859-1')
也可以使用别名latin-1,效果完全相同:
(response.content).decode('latin-1')
ISO-8859-1是单字节编码,每个字节直接映射到对应的Unicode字符,能完美解析这类西班牙语特殊字符。如果后续遇到更多扩展字符,也可以尝试cp1252(Windows Latin-1扩展编码),它兼容ISO-8859-1并支持更多特殊符号,但当前场景下ISO-8859-1已足够解决问题。
内容的提问来源于stack exchange,提问作者Matias Lucero
相关产品推荐
相关产品推荐

