语意识别与智能机器人设计概要.docVIP

  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  4. 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  5. 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  6. 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  7. 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
PAGE / NUMPAGES 语意识别与智能机器人设计 摘要:语音识别技术在智能设计方面的应用广泛。 AP7003型 IC 是一款性能优良和价格低廉的语音识别电路,文中介绍它的基本电路及其在机器人设计中的一些应用友及主意识别系统的基本原理,为智能机器人的设计提供了一种思路。 关键词: AP7003 语音识别 智能机器人 目标词 语音识别技术以语言为研究对象,涉及生理学、语言学、计算机及信号处理等多个领域,是语言信号处理的一个重要研究方向,在智能控制、多媒体、人机对话等方面有着极其广泛的应用前景。 语音识别技术 语音识别技术首先要提取语音特征参量,也就是从语言信号中提取语音识别的有用信息。语音特征参量的提取要考虑单词选定位置的基音、鼻辅音的频谱、元音的频谱、擦音的频谱等要素。语音识别技术也必须有模式匹配及模型训练技术,其中主要包括动态时间规整技术、 HMM模型和人工神经网络。时间规整是把一个单词内的时变特征变为一致的过程,在时间规整过程中,作为单词的时间轴要不均匀的扭曲或弯曲,使其行征为模型特征对正,该技术是一种有力的矫正措施,对提高系统的识别精度极为有效。人工神经网络是一个自适应非线性动力学系统,模拟人体大脑活动的基本原理,具有学习、技艺、判 断、对比和概括等能力。另外,语音识别单元的选取也是语音识别的重要一步,语言识别单元有单词、音节和音素。对于汉语而言,主要选取音节单元, 因为汉语是单音节结构的语言,而英语是多音节的语言,汉语约有 400 个音节,数量相对较少,便于识别。 AP7003 型语音识别电路 AP7003是一款低成本语音识别专用集成电路,内置麦克风放大器、 A/D 转换器、语音处理器和 I/O 控制器,经预处理后可识别 12 组不同的字词,每组 1.5s 时长,可连词或单词识别。可广泛应用于玩具、识别转控和自动答录等领 域。 AP7003的功能框图如图 1 所示。表 1 给出 AP7003的引脚功能。 表 1 AP7003 的引脚功能 引脚名称 功 能 GNDD 数字地 LED1 低电平存放 LED驱动脚,能设计成语音输入指示,适合于标准 应用 低电平存放 LED驱动脚,在标准应用线路中设计成语音输入验 DLED2 证结果的标志 DPOB1-POB4 输出口,作为键盘扫描用,标准应用 DPIT1-PIT4 低电平有效输入口,内部有上拉电阻器,能设计成输入口或键 盘的输入标准应用 DVDDD 数字电源 VDD DCAPV 去耦电容器,电容器必须接在此引脚到地之间,用于内部的电 压基准 DOSCI 频率振荡器控制脚,接一个 56k 电阻器到地 DPIM1PIM2 普通输入脚,能设计成模式控制输入,用于标准电路 DTEST 测试引脚,用于生产测试 DPOSL 输出模式选择,用于输出 A 口,若 ProtA 是高电平有效,则以 POSL接高电平;若低电平有效则接地 GNDA 模拟地 TREF 语音输入阀电压控制 A2OUT 输出第二放大器 AIIN 第一(前级)放大器反相输入 A1OUT 前级放大输出 MICP 麦克风的正电源脚 VDDA 模拟电路正电源 POA-POA12 输出口 PORES 高电平有效输入,清除输出口 A 状态 AP7003的主要特征如下: ·内置麦克风放大器 ·内置 A/D 转换器 ·采用 DIP40 双列直插式封装 ·能识别 12 组 1.5s 时长字词 I/O : 2 个普通输入, 4 个触发输入, 2 个输出口分别有 4 个、 12 个输出, 2 个 LED驱动 AP7003具有二种工作模式,即录音模式和识别模式,在进入识别模式之 前,应先将目标词录入电路内。在 AP7003内有 12 个存贮体用于存贮 12 组不同 的字句,每个存贮体可存贮 1.5s 时长的字句,可通过键盘或按程序编制的顺序选择存贮体来录入及存放目标词。语音可通过外部麦克风或其他媒体录入电路内,经内部处理后以不同的数字特征信号保存在存贮体中。 图 2 目标词录入电路内后即可将工作模式转换到识别模式,工作时电路将当前语音与事先录入存贮体的目标词语音相比较,如果语音特征相匹配,则在电路的相应输出端输出高电平或低电平。 声控机器人设计 语音识别电路广泛应用在智能控制中,把这种电路应用在智能机器人设计中,使机器人初步具有与人对话的能力,且机器人的操作具有普遍性,极大地提高了操作者的兴趣,图 2 是机器人电路的主要原理框图。 图 2 中按键的定义如表 2 所示。上电后 12 个存贮器在录入目标词之前必须清空,开始录入目标词时使 LED1有效,录入后电路将进入识别模式。 表 2 按键的定义 Key NO. 12Key (PIM1=1) 1 Store Word1 2 Store Word2 3 Stroe Word3 4 Store

文档评论(0)

158****3214 + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档