You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Shell脚本合并XML文件的格式错误修正方案咨询

修改Shell脚本合并XML为单根节点方案

针对你的需求——将多个含<DataPDU>根节点的XML合并为一个合规的单根节点XML,保留一份<ns2:Revision>,合并所有<ns2:Header>、<ns2:Body>内容,以下是两种可行的Shell脚本修改方案:

方案一:使用sed实现(结构固定时首选)

假设待合并的XML文件均为当前目录下的*.xml,脚本逻辑为:

  1. 提取第一个文件的完整根节点框架(含<DataPDU>开头、<ns2:Revision>),移除其末尾的</DataPDU>标签;
  2. 遍历剩余文件,移除它们的<DataPDU>开头、<ns2:Revision>部分及</DataPDU>结尾,仅保留<ns2:Header>和<ns2:Body>内容追加到结果文件;
  3. 最后统一添加</DataPDU>闭合标签。

具体脚本:

# 获取第一个待合并的XML文件
first_file=$(ls *.xml | head -1)

# 处理第一个文件:保留根节点开头和Revision,移除末尾的闭合标签
sed '/<\/DataPDU>/d' "$first_file" > merged.xml

# 处理剩余所有XML文件
for file in *.xml; do
  # 跳过第一个文件和生成的结果文件
  if [ "$file" != "$first_file" ] && [ "$file" != "merged.xml" ]; then
    # 移除开头到</ns2:Revision>的内容,以及末尾的闭合标签,仅保留Header和Body
    sed -e '1,/<\/ns2:Revision>/d' -e '/<\/DataPDU>/d' "$file" >> merged.xml
  fi
done

# 添加根节点的闭合标签
echo '</DataPDU>' >> merged.xml

方案二:使用awk实现(更灵活,适配复杂格式)

如果XML文件的换行、缩进不固定,awk的文本处理能力更适配,脚本逻辑与sed一致,但容错性更强:

awk '
# 处理每个文件的第一行
FNR == 1 {
  if (NR == 1) {
    # 第一个文件:标记处于根节点内,正常输出
    in_root = 1
  } else {
    # 后续文件:标记跳过开头到Revision的内容
    skip = 1
  }
}

# 遇到Revision结束标签时,关闭后续文件的跳过标记
/<\/ns2:Revision>/ {
  if (skip) {
    skip = 0
    next
  }
}

# 遇到根节点闭合标签时,跳过输出
/<\/DataPDU>/ {
  if (in_root) {
    in_root = 0
    next
  } else {
    next
  }
}

# 非跳过状态时输出内容
!skip {
  print
}

# 最后添加根节点闭合标签
END {
  print "</DataPDU>"
}
' *.xml > merged.xml

注意事项

  • 确保所有待合并XML的结构一致,均包含<DataPDU>根节点、<ns2:Revision>、<ns2:Header>、<ns2:Body>元素;
  • 若XML的命名空间前缀(如ns2)有变化,需对应修改脚本中的标签匹配字符串;
  • 合并后可使用XML校验工具(如xmllint)验证结果是否合规:xmllint merged.xml

内容的提问来源于stack exchange,提问作者Baldie47

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.16 17:15:40