Shell脚本合并XML文件的格式错误修正方案咨询
修改Shell脚本合并XML为单根节点方案
针对你的需求——将多个含<DataPDU>根节点的XML合并为一个合规的单根节点XML,保留一份<ns2:Revision>,合并所有<ns2:Header>、<ns2:Body>内容,以下是两种可行的Shell脚本修改方案:
方案一:使用sed实现(结构固定时首选)
假设待合并的XML文件均为当前目录下的*.xml,脚本逻辑为:
- 提取第一个文件的完整根节点框架(含
<DataPDU>开头、<ns2:Revision>),移除其末尾的</DataPDU>标签; - 遍历剩余文件,移除它们的
<DataPDU>开头、<ns2:Revision>部分及</DataPDU>结尾,仅保留<ns2:Header>和<ns2:Body>内容追加到结果文件; - 最后统一添加
</DataPDU>闭合标签。
具体脚本:
# 获取第一个待合并的XML文件 first_file=$(ls *.xml | head -1) # 处理第一个文件:保留根节点开头和Revision,移除末尾的闭合标签 sed '/<\/DataPDU>/d' "$first_file" > merged.xml # 处理剩余所有XML文件 for file in *.xml; do # 跳过第一个文件和生成的结果文件 if [ "$file" != "$first_file" ] && [ "$file" != "merged.xml" ]; then # 移除开头到</ns2:Revision>的内容,以及末尾的闭合标签,仅保留Header和Body sed -e '1,/<\/ns2:Revision>/d' -e '/<\/DataPDU>/d' "$file" >> merged.xml fi done # 添加根节点的闭合标签 echo '</DataPDU>' >> merged.xml
方案二:使用awk实现(更灵活,适配复杂格式)
如果XML文件的换行、缩进不固定,awk的文本处理能力更适配,脚本逻辑与sed一致,但容错性更强:
awk ' # 处理每个文件的第一行 FNR == 1 { if (NR == 1) { # 第一个文件:标记处于根节点内,正常输出 in_root = 1 } else { # 后续文件:标记跳过开头到Revision的内容 skip = 1 } } # 遇到Revision结束标签时,关闭后续文件的跳过标记 /<\/ns2:Revision>/ { if (skip) { skip = 0 next } } # 遇到根节点闭合标签时,跳过输出 /<\/DataPDU>/ { if (in_root) { in_root = 0 next } else { next } } # 非跳过状态时输出内容 !skip { print } # 最后添加根节点闭合标签 END { print "</DataPDU>" } ' *.xml > merged.xml
注意事项
- 确保所有待合并XML的结构一致,均包含
<DataPDU>根节点、<ns2:Revision>、<ns2:Header>、<ns2:Body>元素; - 若XML的命名空间前缀(如
ns2)有变化,需对应修改脚本中的标签匹配字符串; - 合并后可使用XML校验工具(如
xmllint)验证结果是否合规:xmllint merged.xml
内容的提问来源于stack exchange,提问作者Baldie47
相关产品推荐
相关产品推荐

