A. VTLN优化
是通过声道规整系数α对于特征参数进行声道规整,一般声道规整系数α范围 0.80-1.20,步进 0.05,所以会有 9 个不同的特征产生,我们再通过一个声道无关的 背景模型(UBM)对于这 9 个特征进行似然打分,找到得分最大的特征所对应的α 值,那么这个α值就是我们寻找的最优的规整系数。这 9 个特征源自于同一个原始 wav,所以其在 UBM 上得分最大的几个高斯,应该是一样的或相差不大。 是通过声道规整系数α对于特征参数进行声道规整,一般声道规整系数α范围
A. VTLN优化
是通过声道规整系数α对于特征参数进行声道规整,一般声道规整系数α范围 0.80-1.20,步进 0.05,所以会有 9 个不同的特征产生,我们再通过一个声道无关的 背景模型(UBM)对于这 9 个特征进行似然打分,找到得分最大的特征所对应的α 值,那么这个α值就是我们寻找的最优的规整系数。这 9 个特征源自于同一个原始 wav,所以其在 UBM 上得分最大的几个高斯,应该是一样的或相差不大。 是通过声道规整系数α对于特征参数进行声道规整,一般声道规整系数α范围