使用nltk.ne_chunk分块后未得到PERSON、GPE标签是什么原因?
你调用nltk.ne_chunk()时传入的binary=True参数是导致输出不符合预期的原因。
binary参数的作用是控制命名实体的输出粒度:
- 当值为
True时,所有识别到的命名实体只会被标记为统一的NE标签,不会细分实体类型 - 当值为
False(该参数的默认取值)时,模型会输出PERSON、GPE、ORG等具体的实体类型,匹配你期望的输出效果
调整后的代码示例:
sent="Azhar is asking what is weather in Chicago today? " chunks = nltk.ne_chunk(nltk.pos_tag(nltk.word_tokenize(sent))) print(list(chunks))
内容的提问来源于stack exchange,提问作者azhar
相关产品推荐
相关产品推荐

