如何在lxml中定义冗余命名空间避免被自动移除
lxml生成冗余命名空间声明的实现方法
lxml默认会对命名空间做规范化处理,自动移除子节点上重复的命名空间声明。如果需要强制保留冗余声明,可按照以下步骤操作:
- 首先导入lxml的etree模块,预定义所有需要的命名空间映射:
from lxml import etree # 全局命名空间映射 ns_map = { "env": "some URI", "ns0": "http://www.w3.org/2001/XMLSchema", "ns1": "http://www.w3.org/2001/XMLSchema-instance" }
- 创建根节点时传入全局命名空间映射:
root = etree.Element("{some URI}Envelope", nsmap=ns_map)
- 逐级创建普通子节点,到需要添加冗余命名空间的节点时,额外为该节点传入包含重复命名空间的nsmap参数:
# 创建普通子节点 body = etree.SubElement(root, "{some URI}Body") get_label_resp = etree.SubElement(body, "{http://www.w3.org/2001/XMLSchema}getLabelResponseElement") result = etree.SubElement(get_label_resp, "{http://www.w3.org/2001/XMLSchema}result") # 为statusMessage节点强制添加冗余的ns0命名空间声明 status_msg = etree.SubElement( result, "{http://www.w3.org/2001/XMLSchema-instance}statusMessage", # 这里传入的nsmap会强制lxml在当前节点输出对应的命名空间声明 nsmap={"ns0": "http://www.w3.org/2001/XMLSchema"} )
- 序列化输出XML时使用默认配置即可,不要开启命名空间优化参数:
xml_content = etree.tostring( root, encoding="utf-8", xml_declaration=True, pretty_print=True ).decode("utf-8") print(xml_content)
输出的XML将完全符合你提供的示例结构,ns1:statusMessage节点会保留冗余的xmlns:ns0声明。如果有多个节点需要添加冗余命名空间,给每个目标节点创建时都传入对应nsmap即可。
内容的提问来源于stack exchange,提问作者evgenyorlov1
相关产品推荐
相关产品推荐

