使用Curiosity-AI/Catalyst识别动词后如何获取其原形?
获取Catalyst NLP中动词的原形方法
Catalyst的Token对象自带Lemma属性,该属性对应词汇的标准化原形(词元),对于动词来说就是你需要的原形形式,直接访问即可。
修改你的代码如下:
const string text = "The disastrous cat runs after the fat field mouse."; Catalyst.Models.English.Register(); Storage.Current = new DiskStorage(AppDomain.CurrentDomain.BaseDirectory); var nlp = await Pipeline.ForAsync(Language.English); var doc = new Document(text, Language.English); nlp.ProcessSingle(doc); foreach (var sentence in doc.TokensData) { foreach (var token in sentence) { if(token.Tag == PartOfSpeech.VERB) { // 获取动词原形 string verbRoot = token.Lemma; Console.WriteLine($"识别到的动词原形:{verbRoot}"); } } }
说明
Lemma属性会返回词汇的标准原形,示例中"runs"的Lemma值就是"run"。- 默认初始化的英文NLP pipeline已经包含词形还原组件,无需额外配置即可正常获取
Lemma值。
内容的提问来源于stack exchange,提问作者Mats
相关产品推荐
相关产品推荐

