如何复现斯坦福NLP词性标注演示页面效果及对应命令行?
复现斯坦福Parser演示页面的POS标注效果
要精准复现斯坦福Parser演示页面的POS词性标注效果,你需要在命令里指定和englishPCFG.ser.gz解析器配套的词性标注模型——这是你之前命令里漏掉的关键配置。正确的命令行如下:
java -Xmx500m -cp "*:/models/stanford-english-corenlp-2018-02-27-models.jar" edu.stanford.nlp.pipeline.StanfordCoreNLPServer \ -annotators tokenize,ssplit,pos \ -pos.model edu/stanford/nlp/models/pos-tagger/english-bidirectional-distsim/english-bidirectional-distsim.tagger \ -port 9001 \ -timeout 10000
关键说明:
- 那个演示页面使用的
englishPCFG.ser.gz解析器,默认搭配的POS标注器就是english-bidirectional-distsim.tagger,这是斯坦福CoreNLP中与PCFG解析器配套的标准标注模型。 - 你使用的2018-02-27版本模型包已经自带该标注器,无需额外下载。
- 我把超时时间调整到10秒(10000毫秒),避免短时间处理请求时触发超时,你可以根据自身需求修改这个数值。
内容的提问来源于stack exchange,提问作者Nathan G
相关产品推荐
相关产品推荐

