Python 2.7字符串替换问题:如何将™替换为%E2%84%A2?
解决Python 2.7中™替换失效的问题
咱们先拆解下你遇到的两个核心问题,再给你针对性的修复方案:
首先,Python里的字符串是不可变对象——replace()方法不会直接修改原字符串,而是返回一个全新的字符串。你代码里的第二行temp_title.replace('™', '%E2%84%A2')没有把结果重新赋值给temp_title,相当于这一步替换完全没生效,原变量还是原来的样子。
其次,Python 2.7对Unicode字符的处理比较“挑剔”:虽然你加了# -- coding: utf-8 --声明文件编码,但代码里直接写的'™'会被当作utf-8编码的字节串;如果你的title参数是Unicode类型,字节串和Unicode字符串之间的匹配就会失败,自然替换不了。
修复后的代码
# -- coding: utf-8 -- def create_link(title): # 先统一编码:如果传入的title是字节串,先解码为Unicode if isinstance(title, str): title = title.decode('utf-8') # 替换空格,用Unicode字符串确保匹配 temp_title = title.replace(u' ', u'%20') # 关键:把replace的结果重新赋值给变量,同时用Unicode的™匹配 temp_title = temp_title.replace(u'™', u'%E2%84%A2') # 拼接URL后转成字节串返回(符合Python 2.7的常见使用场景) link = u'https://ApplicationNotes/' + temp_title return link.encode('utf-8')
更稳妥的替代方案
其实Python标准库有专门的URL编码工具urllib.quote(),能自动处理所有特殊字符(包括空格、™这类),比手动替换靠谱得多:
# -- coding: utf-8 -- import urllib def create_link(title): # 统一转成Unicode再处理 if isinstance(title, str): title = title.decode('utf-8') # 自动编码所有需要转义的字符 encoded_title = urllib.quote(title.encode('utf-8')) link = 'https://ApplicationNotes/' + encoded_title return link
这个方法不仅能搞定™和空格,还能处理其他你可能没考虑到的特殊字符,避免手动替换遗漏的问题。
内容的提问来源于stack exchange,提问作者Jennifer Zou
相关产品推荐
相关产品推荐

