使用BeautifulSoup解析XBRL文件时提取xbrli:context标签id的方法
解决方法
你可以直接从xbrli:context对应的BeautifulSoup Tag对象中提取id属性,不需要打印整个节点内容,示例代码如下:
for context in contextsoup: # 方法1:字典索引方式,无id属性时会抛出KeyError print(context["id"]) # 方法2:get方法更容错,无id时返回None,建议优先使用 # print(context.get("id"))
上述代码会直接输出所有xbrli:context节点的id值,比如样例中的context0。
逻辑说明
- 你之前打印的
child.name是标签的名称值,对应xbrli:context,不属于标签属性范畴 - XML/HTML节点的所有属性都存储在BeautifulSoup Tag对象的属性字典中,id作为标签的内置属性,可直接通过键名读取
内容的提问来源于stack exchange,提问作者Bob
相关产品推荐
相关产品推荐

