如何在Notepad++中提取XML指定标签数据并导出到新文件
Notepad++ 提取XML指定字段操作步骤
你可以直接用Notepad++自带的正则替换功能完成需求,无需安装额外插件,操作步骤如下:
- 第一步:提前备份原始XML文件,避免操作失误丢失数据。
- 第二步:用Notepad++打开目标XML文件,按下
Ctrl+H调出「替换」窗口,在窗口底部的「查找模式」选择正则表达式,同时取消勾选「. 匹配换行符」。 - 第三步:填写查找和替换规则:
如果你要提取的是示例中的Name、ContactNo、Zip三个字段,查找目标填写:
替换为填写你需要的格式,示例要求的格式对应内容为:^.*<Name>(.*?)</Name>.*<ContactNo>(.*?)</ContactNo>.*<Zip>(.*?)</Zip>.*$
如果需要提取6-7个字段,只需要在查找正则里按照<$1<$2<$3.*<标签名>(.*?)</标签名>的格式往后补对应的标签匹配规则,替换内容里对应增加<$4、<$5等占位符即可,占位符数字和正则里分组的顺序一致。 - 第四步:先点击「查找全部」,核对匹配到的行数和你文件里
<document>节点的数量一致,确认规则没问题后点击「全部替换」。 - 第五步:替换完成后,删除文件最开头的根节点行(
<documents xmlns:xsi=.......>)和末尾的</documents>行,剩下的内容就是你需要的目标格式,直接保存为新文件即可。
后续导入Excel的时候,分隔符选择<就能自动拆分各字段到不同列。
内容的提问来源于stack exchange,提问作者user3920770
相关产品推荐
相关产品推荐

