检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:吴礼福[1] 姚志强[1] 戴蓓蒨[1] 李辉[1]
机构地区:[1]中国科学技术大学电子科学与技术系,安徽合肥230026
出 处:《中国科学技术大学学报》2006年第5期476-480,共5页JUSTC
基 金:国家自然科学基金(60272039)资助
摘 要:给出了一种采用音源特征信息提高以声道倒谱参数为特征的话者确认系统噪声鲁棒性的方法,提取了两类音源特征参数:短时(单帧)特征参数和较长时(多帧)特征参数,并分别构建了两个利用音源特征参数的与文本无关的话者确认辅助子系统.采用线性加权对主、辅子系统的输出进行融合.在NIST’03数据库上100个男性话者的对比实验表明,音源特征参数具有良好的噪声鲁棒性,声道特征与音源特征具有较强的互补性,尤其是在较强的噪声背景下,利用音源特征可以有效地提高以声道倒谱参数为特征的确认系统的鲁棒性.Two approaches that use the Pitch and Energy of sound source to improve the performance of speaker verification were presented. The first approach extracted speaker-dependent features of the sound source by short-term analysis. The second approach captured the Pitch and Energy dynamics by taking into account the statistics of multi-frames. For each feature, a model was established by means of GMM-UBM, and then the weighted linear sum of scores from each model was computed as the fusion score. Experiments conducted on the NIST'03 database show that sound source features have a complementary effect on MFCC. Further more, these features are more robust than MFCC and can greatly improve robustness in noisy environments.
关 键 词:音源特征 话者确认 噪声鲁棒性 高斯混合模型-背景模型
分 类 号:TN912.34[电子电信—通信与信息系统]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:3.145.158.23