22. 语音识别的原理(1).pptxVIP

  • 4
  • 0
  • 约小于1千字
  • 约 5页
  • 2026-04-06 发布于陕西
  • 举报

人工智能与机器学习基础知识——语音识别的原理

语音识别的原理语音识别技术语音识别技术以语音信号为研究对象,是语音信号处理的一个重要研究方向。其最终目标是实现人与机器进行自然语言通信。语音机器人

语音识别的原理声音实际上是一种波,俗称声波。常见的mp3、wmv等格式都是压缩格式,必须转成非压缩的纯波形文件来处理,比如wav文件。在开始语音识别之前,有时需要把首尾端的静音切除,降低对后续步骤造成的干扰。要对声音进行分析,需要对声音分帧,也就是把声音切开成一小段一小段,每小段称为一帧。

语音识别的原理分帧后,语音就变成了很多小段,但波形在时域上几乎没有描述能力,因此必须将波形作变换。常见的一种波形变换方法是提取MFCC特征,把每一帧波形变成一个多维向量,可以简单地理解为这个向量包含了这帧语音的内容信息。这个过程叫做声学特征提取。至此,声音就成了一个12行、N列的一个矩阵,成为观察序列。

文档评论(0)

1亿VIP精品文档

相关文档