基于Fisher准则的说话人识别特征参数提取研究的中期报告.docxVIP

  • 7
  • 0
  • 约1.56千字
  • 约 3页
  • 2024-04-27 发布于上海
  • 举报

基于Fisher准则的说话人识别特征参数提取研究的中期报告.docx

基于Fisher准则的说话人识别特征参数提取研究的中期报告

一、研究背景

说话人识别(SpeakerRecognition)是指在语音识别中用于识别不同说话人的独特声学特性,其应用包括电话安全、语音售货机等。在说话人识别任务中,通常通过提取一系列特征参数,并使用分类器进行分类。

当前,基于深度学习的说话人识别方法在取得显著进展的同时,传统的基于GMM-UBM的方法也仍然被广泛应用。在GMM-UBM方法中,经典的特征参数提取方法包括Mel频率倒谱系数(Mel-frequencyCepstralCoefficients,MFCC)和线性预测系数(LinearPredictiveCoding,LPC)等。然而,这些特征虽然在许多应用中表现良好,但它们本身并没有考虑到说话人的个性差异,因此无法提取具有区分性的说话人特征。

Fisher准则是一种经典的线性判别分析方法,可以通过寻找最优投影方向将数据投影到一维空间中,并最大化类间距离和最小化类内距离,从而提高分类效果。因此,在说话人识别中,基于Fisher准则的特征参数提取方法被认为能够提取出具有较高区分度的聚类特征。

本研究旨在探究基于Fisher准则的特征参数提取方法在说话人识别中的效果,并通过实验验证其可行性和有效性。

二、研究方法

1.数据集

本研究使用了TIMIT语音数据集中的说话人识别部分作为训练集和测试集。TIMIT

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档