如何用Python的re.sub忽略大小写为指定单词添加<b>标签
解决忽略大小写的单词批量加粗问题
你的核心问题是正则匹配未启用忽略大小写模式,且替换逻辑依赖固定大小写的字典,导致无法覆盖各类大小写变体。直接修改两点就能完美解决:
- 给正则匹配添加忽略大小写标志(
re.IGNORECASE或简写re.I),让正则能匹配任意大小写的目标单词。 - 替换时直接使用匹配到的原字符串包裹标签,不用预定义字典——这样自动保留原单词的大小写格式,不管是
Test、TEST还是tesT都能正确处理。
修正后的完整代码:
import re bolds = ['test', 'tested'] # 忽略大小写为这些单词添加粗体 text = "Test lorem tested ipsum dolor sit amet test, consectetur TEST adipiscing elit tesT." # 构建正则模式,启用忽略大小写匹配 pattern = r'\b(?:' + "|".join(bolds) + r')\b' text_bolded = re.sub(pattern, lambda m: f'<b>{m.group()}</b>', text, flags=re.IGNORECASE) print(text_bolded)
输出结果:
<b>Test</b> lorem <b>tested</b> ipsum dolor sit amet <b>test</b>, consectetur <b>TEST</b> adipiscing elit <b>tesT</b>.
为什么之前的方法不行?
- 原代码没加
flags=re.IGNORECASE,正则只能精确匹配小写的test、tested,对大小写变体视而不见。 - 你尝试添加大小写变体到列表的方法,只能覆盖有限的几种情况(首字母大写、全大写),无法处理
tesT这类随机混合的大小写,还会让列表冗余。
内容的提问来源于stack exchange,提问作者tikka
相关产品推荐
相关产品推荐

