基于JFA的汉语耳语音说话人识别的中期报告.docxVIP

  • 0
  • 0
  • 约1.11千字
  • 约 2页
  • 2023-11-23 发布于上海
  • 举报

基于JFA的汉语耳语音说话人识别的中期报告.docx

基于JFA的汉语耳语音说话人识别的中期报告 一、研究背景 随着社会的不断发展,语音技术已经被广泛应用于各个领域,其中语音识别和语音合成技术是应用最为广泛的两个领域。语音识别技术是指通过计算机程序识别人的语音并将其转化成文字,而语音合成技术则是将文字转化成语音。而在实际应用中,我们需要对发音相同或相似的不同人进行区分,这就是说话人识别技术的应用。 目前,基于JFA(Joint Factor Analysis)的说话人识别技术已经被广泛应用于语音技术领域。与传统的GMM(高斯混合模型)和i-vector(identity vector)方法相比,JFA模型可以在更小的训练数据集上获得更好的识别性能,而且对于同一说话人的不同录音数据可以进行更好的建模。 针对汉语耳语音的说话人识别问题,本研究基于JFA模型,提出了一种新的汉语耳语音说话人识别方法。 二、研究内容 1. 数据集构建 本研究使用清华大学提供的汉语耳语音数据集进行实验。该数据集共有22名说话人,每位说话人提供了10个不同的汉语耳语音样本。 2. 特征提取 本研究使用Mel频率倒谱系数(MFCC)作为汉语耳语音的特征。在MFCC提取过程中,我们选择每帧时长为20毫秒,帧移为10毫秒,滤波器组数为40。最终,我们得到了22个说话人,每个说话人对应10个MFCC特征向量。 3. JFA模型 在本研究中,我们使用JFA模型来进行说话人识

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档