M201371744郭伟刚孤立汉语数字语音识别系统.docVIP

  • 4
  • 0
  • 约3.44千字
  • 约 6页
  • 2017-06-14 发布于四川
  • 举报

M201371744郭伟刚孤立汉语数字语音识别系统.doc

孤立汉语数字语音识别系统 摘要:本文通过提取声音信号的Mel倒谱系数作为特征,利用动态时间规整技术实现匹配算法,实现了特定人孤立汉语数字语音的识别,并利用Matlab编写了简单的图形用户界面。 关键词:语音识别;MFCC;DTW 一、引言 语言是人类所特有的最重要最自然的交流工具,也是人类信息的重要来源之一。让机器拥有“听懂”人类口述语言的能力,将使得人与计算机之间的沟通变得更为方便快捷。自从1952年ATT贝尔实验室的开发出能识别十个英文数字的Audry系统以来,语音识别技术已经得到了飞速发展,其中IBM、Microsoft、Apple等公司在语音识别技术实用化上的巨资投入也使得这项技术在日常生活中得到广泛应用。计算机技术的发展大大促进了数字信号处理技术的开发与应用,也使得更多的技术应用在语音识别方面。 MATLAB是一种功能强大、效率高、交互性好的数值计算和可视化计算机高级语言,它将数值分析、信号处理和图形显示有机地融合为一体。本文就是在MATLAB基础上进行。 图1 典型语音识别系统 目前常用的技术有特征参数匹配法、隐马尔科夫法和神经网络法。其中语音特征参数可以是能量、基音频率、过量率、共振峰值等,目前常用的参数为基于发声声道特征模型,通过线性预测分析的线性预测倒谱系数LPCC和基于人耳的听觉机理,反映听觉特性,模拟人耳对声音频率感知的梅尔倒谱系数MFCC等。 MFCC的频

文档评论(0)

1亿VIP精品文档

相关文档