会议语音混响消除及其大词汇量连续语音识别研究.pdf

会议语音混响消除及其大词汇量连续语音识别研究.pdf

摘要 摘要 语音识别技术的应用前景是无限的。应用语音的自动理解和翻译,可以消除 人类相互交往的语言障碍。随着Internet网的爆炸性扩张,电子商务的迅速发展, 语音识别技术将为网上会议、商业管理、医药卫生、教育培训等各领域带来极大 的便利。 随着近代计算机技术的飞速发展,大词汇量连续语音识别系统已经取得了较 高的识别准确率,语料库的选择也由干净、单一的实验室环境下语料转为混杂着 噪音、混响复杂环境下的语料。真实环境下的语音识别成为研究的热点。 论文围绕美国加州伯克利大学ICSI研究所提供的会议语料库,分析了影响识 别率的三个原因:噪音、混响、说话人重叠。通过研究,旨在应用各种算法提高 ICSI会议语料库的基线识别率。论文首先对语音识别系统的结构、语音模型、语 言模型进行描述,然后分析了混响信号和混响模型,陈述了消除混响的基本方法, 接着描述了ICSI语料库的构造和特点,最后分别提出了三种算法来消除噪音、混 响和说话人重叠并且进行了实验。对ICSI数字语料库进行识别时通过减谱法和长 时减谱增强语音后,识别率由64%上升到91%。在对ICSI会议语料库进行识别时, 根据上述的两种方法加上说话人检测消除说话人重叠技术,识别率提高了30%。 本文结合了信号处

文档评论(0)

1亿VIP精品文档

相关文档