《计算机技术与发展杂志》发表论文赏析

基于i-vector和深度学习的说话人识别

来源:计算机技术与发展杂志2017年第06期北京时间:

作者:林舒都;邵曦

摘要:为了提高说话人识别系统的性能,在研究基础上提出了一种将深度神经网络(Deep Neural Nerwork,DNN)模型成果与i-vector模型相结合的新方案.该方案通过有效的神经网络构建,准确地提取了说话人语音里的隐藏信息.尽管DNN模型可以帮助挖掘很多信息,但是i-vector特征并没有完全覆盖住声纹特征的所有维度.为此,在i-vector特征的基础上继续提取维数更高的i-supervector特征,有效地避免了信息的不必要损失.为证明提出方案的可行性,采用对TIMIT等语音数据库630个说话人的语音进行了训练、验证和测试.验证实验结果表明,在提取i-vector特征的基础上提取i-supervector特征的说话人识别同等错误率有30%的降低,是一种有效的识别方法.

关键词:说话人识别;深度神经网络;i-vector;声纹特征

填文献完整题目 获取完整文献

填写需求
联系方式
注:学术顾问会在1小时内联系您,请留意!