如何在Notepad++中使用正则表达式提取XML中的RSS xmlUrl内容
在Notepad++中提取RSS列表里的xmlUrl值
没问题,我来帮你搞定这个需求!你要从一堆XML格式的RSS条目里只保留每个xmlUrl的内容,用Notepad++的正则替换就能轻松实现,具体步骤如下:
- 把你的RSS列表文本文件在Notepad++中打开
- 按下快捷键
Ctrl+H打开替换窗口(或者通过顶部菜单栏「搜索」→「替换」打开) - 在替换窗口的左下角,勾选「正则表达式」选项(如果你的条目是跨行的,可以顺便勾选「.匹配换行符」,看你提供的示例是单行条目,所以不用勾)
- 在「查找目标」框里输入:
.*?xmlUrl="([^"]+)".* - 在「替换为」框里输入:
\1 - 点击「全部替换」按钮,搞定!
简单解释下这个正则的逻辑:
.*?:非贪婪匹配任意字符,确保我们只会匹配到第一个xmlUrl="之前的内容,不会“多吃”其他部分xmlUrl=":精准定位到xmlUrl属性的开头标识([^"]+):这是一个捕获组,专门抓取双引号之间的所有内容(也就是我们要的RSS地址),[^"]表示除了双引号之外的任意字符".*:匹配xmlUrl值后面的所有剩余内容,确保这些无关内容都会被替换掉
替换之后,你原来的条目就会变成干净的RSS地址列表,比如:
http://feeds.feedburner.com/TechViral http://www.theverge.com/rss/full.xml
内容的提问来源于stack exchange,提问作者Bob C
相关产品推荐
相关产品推荐

