基于上下文的FST转移为何被判定为非确定性?
关于《SPEECH RECOGNITION WITH WEIGHTED FINITE-STATE TRANSDUCERS》图6a中
ae/k_t转移非确定性的解释 你疑惑的核心点在于对FST中上下文编码方式的误解:
在图6a的未确定化FST结构里,转移的输入标签仅为中心音素ae,上下文(左k、右t)是编码在状态中的,而非输入符号的一部分。
根据你给出的非确定性定义——同一输入标签对应多条转移即属于非确定性,在这个FST中,当处于某个起始状态时,输入符号ae可以触发多条不同的转移:比如除了ae/k_t这条转移,还存在其他以ae为中心的三元音转移(比如左上下文为空、右上下文为t的ae/_t,或是左上下文为k、右上下文为空的ae/k_等)。这些转移共享同一个输入标签ae,但对应不同的状态转移路径,完全符合非确定性转移的判定条件。
你之前误以为上下文会消除歧义,是错把上下文当成了输入符号的一部分,但实际上在这个阶段的FST构建中,上下文是作为状态的属性存在的,并没有被包含在输入标签里,所以输入ae时仍有多条转移可选,因此被认定为非确定性转移。
内容的提问来源于stack exchange,提问作者Anantha Krishnan
相关产品推荐
相关产品推荐

