如何在Notepad++中用正则表达式提取title与url字段信息?
在Notepad++中用正则提取指定字段的方法
操作步骤:
- 打开目标文本文件,按下
Ctrl+H调出替换窗口 - 在替换窗口中,勾选「正则表达式」,同时勾选「. 匹配换行符」(该选项在正则表达式选项下方,必须开启才能跨行匹配整个结构块)
- 填入以下规则:
- 查找内容:
(?s).*?("title": ".*?").*?("url": ".*?").*?(?=\s*"description":|$) - 替换为:
$1\n$2\n
- 查找内容:
- 点击「全部替换」,所有结构里的title和url会被单独提取,其余内容自动删除
正则规则说明:
(?s):开启单行模式,让.能匹配换行符,实现跨行匹配完整的结构块("title": ".*?"):精准捕获完整的title行内容,非贪婪匹配避免错误抓取范围("url": ".*?"):同理捕获完整的url行内容(?=\s*"description":|$):通过正向预查定位下一个结构的起始标记("description")或文件结尾,确保每个结构块被独立处理
清理多余空行(可选):
如果替换后存在多余空行,再执行一次替换:
- 查找内容:
^\s*$ - 替换为:(留空)
- 勾选正则表达式后点击「全部替换」即可
内容的提问来源于stack exchange,提问作者Vendrium
相关产品推荐
相关产品推荐

