采用长度规整MAP的说话人分割聚类

来源 :信号处理 | 被引量 : 0次 | 上传用户:xjl982050
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
本文首次提出了长度规整的最大后验估计(MAP)方法,并将其应用到说话人分割聚类中的交叉似然比(CLR)和T-Test这两种度量距离上。传统的MAP方法需要在通用背景模型(UBM)基础上进行统计量的计算,进而对模型参数进行自适应偏移,因此偏移的程度与语音片段的长度正相关。当在度量两个长度不相同的语音片段的相似性时,传统的MAP方法会使得说话人模型刻画不准确,从而影响距离度量。本文在MAP过程中,根据语音的长度对相关因子进行规整,然后再进行模型参数的调整,从而使得模型参数与语音长度无关,更能体现说话人的身份信
其他文献
一个民族的神话蕴涵着一个民族主体意识的内在规定性,是民族精神最初的也最为质朴的纪录。中国上古神话虽然缺乏一个完整的系统,仅散见于《山海经》、《淮南子》、《庄子》、《
《淮南子》认为真人、至人和圣人分别为上世、中世和末世的理想人格。这些理想人格是不同时代的产物,各具特征,但也有着共性,就是他们都清心寡欲,清静无为,注重养心和养性。真人、