You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python XML解析:实现ItemListID与对应POSCode的关联提取

解决嵌套XML中ItemListID与POSCode关联匹配的方案

核心思路

针对嵌套XML的结构,关键是遍历节点时维护关联上下文——先定位到ItemList节点,提取对应的ItemListID作为当前上下文,再遍历该节点下的所有POSCode,直接完成关联匹配,而非零散提取孤立的键值对。

假设你的XML结构示例(基于常见场景补全)

<Root>
  <ItemList>
    <ItemListID>ITEM_001</ItemListID>
    <Details>
      <POSCode>POS_1001</POSCode>
      <OtherInfo>...</OtherInfo>
    </Details>
    <Details>
      <POSCode>POS_1002</POSCode>
      <OtherInfo>...</OtherInfo>
    </Details>
  </ItemList>
  <ItemList>
    <ItemListID>ITEM_002</ItemListID>
    <Details>
      <POSCode>POS_2001</POSCode>
      <OtherInfo>...</OtherInfo>
    </Details>
  </ItemList>
</Root>

优化后的解析代码

基于xml.etree.ElementTree实现上下文追踪:

import xml.etree.ElementTree as ET

# 解析目标XML文件
tree = ET.parse('your_target.xml')
root = tree.getroot()

# 存储关联结果的列表
matched_result = []

# 遍历所有ItemList节点(支持深层嵌套)
for item_list_node in root.findall('.//ItemList'):
    # 提取当前ItemList的ID
    current_item_id = item_list_node.find('ItemListID').text
    # 定位当前ItemList下所有的POSCode节点
    pos_code_nodes = item_list_node.findall('.//POSCode')
    # 逐个完成关联并存入结果
    for pos_node in pos_code_nodes:
        matched_result.append({
            'ItemListID': current_item_id,
            'POSCode': pos_node.text
        })

# 输出关联表格
print("| ItemListID | POSCode |")
print("|------------|---------|")
for entry in matched_result:
    print(f"| {entry['ItemListID']} | {entry['POSCode']} |")

关键说明

  • 用.//ItemList的XPath语法可以定位XML中所有层级的ItemList节点,避免遗漏深层嵌套的结构
  • 如果你的XML中POSCode的嵌套路径固定(比如仅在Details下),可以把findall('.//POSCode')改为findall('Details/POSCode'),提升解析效率
  • 最终结果可以直接写入CSV文件或导入表格工具,只需修改输出逻辑即可

输出示例表格

ItemListIDPOSCode
ITEM_001POS_1001
ITEM_001POS_1002
ITEM_002POS_2001

内容的提问来源于stack exchange,提问作者Bushido_T

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.06 04:00:05