LUIS西班牙语datetimev2实体未识别‘la semana pasada’的优化问询
我之前在做西语LUIS聊天机器人时也碰到过类似的datetimev2识别盲区,针对“la semana pasada”这类短语,你可以试试下面几个优化方法:
扩充自定义短语列表:
进入LUIS门户的「Entities」页面,创建一个Phrase List Entity,把“la semana pasada”、“semana pasada”、“la semana anterior”这类同义或相似的时间短语都加进去,然后将这个短语列表关联到datetimev2实体。这样能帮助LUIS模型把这些短语和时间实体做关联,填补预构建实体的覆盖缺口。批量添加示例 utterance:
在你对应的意图下,多补充包含“la semana pasada”的例句,比如:Quiero consultar las facturas de la semana pasada
¿Cuántos clientes atendimos la semana pasada?
Mostrar métricas de la semana pasada
越多贴合实际场景的示例,模型越能准确识别该短语对应的时间实体。确认文化设置正确性:
检查你的LUIS应用的文化是否设置为es-es(西班牙语-西班牙),datetimev2的识别逻辑是和文化强绑定的,如果选错了文化(比如选成es-mx但短语是西班牙用法),会直接影响识别效果。使用Patterns强制匹配:
如果你的对话有固定句式,比如用户常说“[动作] de la semana pasada”,可以创建Patterns来固定识别逻辑。比如定义模式:{TuIntento} [de] la semana pasada
把模式里的时间部分关联到datetimev2实体,这样只要用户输入符合这个句式,就能强制触发时间实体识别。微调datetimev2实体配置:
进入datetimev2实体的详情页,确认是否开启了所有与“过去时间”相关的子类型(比如past、daterange),有些时候默认配置可能没有完全启用所有必要的子类型,开启后能提升对过去时间短语的识别能力。
内容的提问来源于stack exchange,提问作者gazambuja

