如何使用Python RE去除字符串多余换行、制表符并通过re.split单行拆分
问题解答
可以通过re.split()单条语句实现需求,实现代码如下:
import re # 单条拆分语句 result = re.split(r'\s*\band\b\s*', "good \nand bad and\n\t not great and awesome")
正则说明
\s*:匹配0个及以上任意空白字符,包含题目中要移除的\n、\t和普通空格\band\b:匹配独立的单词and,加单词边界\b是为了避免误拆分包含and的其他完整单词(例如sand、anderson这类不会被错误切割)- 把
and前后的空白和and本身整体作为分隔符,拆分后得到的元素自动剔除了多余转义字符,直接符合预期输出["good", "bad", "not great", "awesome"]。
如果你的业务场景中确定不会出现包含and的其他单词,也可以简化正则为r'\s*and\s*',效果一致。
内容的提问来源于stack exchange,提问作者Winston
相关产品推荐
相关产品推荐

