如何修改Python代码实现按行提取XML-TEI诗歌文件中w标签的pos属性并以列表形式输出
提取XML-TEI诗歌中每行标签的pos属性列表
没问题,我帮你调整代码实现想要的输出格式。你当前的代码是逐个打印每个pos属性,而我们需要先把每行的所有pos收集成一个列表,再和单词数量一起输出。
修改后的代码如下:
result_4 = bs_content.find_all('l') for line in result_4: # 收集当前行所有<w>标签的pos属性 pos_list = [w.get('pos') for w in line.find_all('w')] # 打印数量和对应的pos列表 print(len(pos_list), pos_list)
代码说明:
- 用列表推导式一次性把当前行所有
<w>标签的pos属性提取出来,存入pos_list - 直接打印
pos_list的长度和列表本身,完美匹配你想要的输出格式
输出效果:
运行这段代码后,你会得到和期望完全一致的结果:
5 ['PREP', 'REL', 'ADV', 'PRON', 'PUN'] 2 ['ADV', 'V'] 3 ['PREP', 'REL', 'ADV']
内容的提问来源于stack exchange,提问作者Andrea
相关产品推荐
相关产品推荐

