使用allennlp.predictors.predictor做依赖解析时tags和predicted_dependencies数量查询
这两个字段的具体数值没有统一固定值,完全取决于你当前加载的预训练模型训练时采用的标签体系,具体说明如下:
- 关于
tags字段:该字段存储词性标注结果。如果你使用的是AllenNLP官方提供的默认英文依赖解析预训练模型,默认采用通用POS(Universal Part-of-Speech)标签集,共17种基础标签;如果加载的是基于宾州树库(PTB)训练的模型,采用细粒度PTB POS标签,共36种标签。
你可以直接调用以下代码获取当前使用模型的tags准确数量:print(predictor._model.vocab.get_vocab_size("pos_tags")) - 关于
predicted_dependencies字段:该字段存储依存句法关系标签。官方默认英文依赖解析模型基于通用依存(Universal Dependencies, UD)标准训练,通用核心依存关系共37种,不同UD版本、特定领域训练的模型标签数量会有小幅差异。
你可以直接调用以下代码获取当前使用模型的predicted_dependencies准确数量:print(predictor._model.vocab.get_vocab_size("labels"))
注意:如果使用自定义训练的依赖解析模型,两个字段的数量完全由训练时所用标注数据的标签体系决定,可直接通过上述两个接口获取对应数值。
内容的提问来源于stack exchange,提问作者Alva
相关产品推荐
相关产品推荐

