Python中如何将存储Unicode字符的str类型变量转为UTF-8编码?
Python Unicode字符串转UTF-8编码方案
在Python 3环境中,str类型本质就是Unicode字符序列,你可以直接调用字符串内置的encode()方法,指定编码格式为utf-8完成转换,转换后的结果为bytes类型:
# 示例代码 x = '\u062f\u0631 \u0627\u0628\u0644' x_utf8 = x.encode('utf-8') # 验证转换结果 print(x_utf8) # 输出:b'\xd8\xaf\xd8\xb1 \xd8\xa7\xd8\xa8\xd9\x84' print(type(x_utf8)) # 输出:<class 'bytes'>
补充说明
encode()方法如果不传入编码参数,默认就会使用utf-8编码,不过显式指定编码格式可读性更强,更推荐使用- 如果你后续需要把UTF-8编码的bytes数据转回Unicode字符串,调用
decode('utf-8')方法即可
内容的提问来源于stack exchange,提问作者mehdi nora
相关产品推荐
相关产品推荐

