You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何修改Python代码实现按行提取XML-TEI诗歌文件中w标签的pos属性并以列表形式输出

提取XML-TEI诗歌中每行标签的pos属性列表

没问题,我帮你调整代码实现想要的输出格式。你当前的代码是逐个打印每个pos属性,而我们需要先把每行的所有pos收集成一个列表,再和单词数量一起输出。

修改后的代码如下:

result_4 = bs_content.find_all('l')
for line in result_4:
    # 收集当前行所有<w>标签的pos属性
    pos_list = [w.get('pos') for w in line.find_all('w')]
    # 打印数量和对应的pos列表
    print(len(pos_list), pos_list)

代码说明:

  • 用列表推导式一次性把当前行所有<w>标签的pos属性提取出来,存入pos_list
  • 直接打印pos_list的长度和列表本身,完美匹配你想要的输出格式

输出效果:

运行这段代码后,你会得到和期望完全一致的结果:

5 ['PREP', 'REL', 'ADV', 'PRON', 'PUN']
2 ['ADV', 'V']
3 ['PREP', 'REL', 'ADV']

内容的提问来源于stack exchange,提问作者Andrea

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.04.30 15:37:26