仪表保护箱如何分类及应用(仪表保护箱如何分类及应用图片) 羊角梳子和牛角梳子哪个更好(银梳子和牛角梳哪个好) 进出口贸易怎么做(外贸出口流程) kingsoft是什么意思可以删除吗(kingsoft可以删除) 淘宝试用攻略(淘宝试用攻略在哪里看) 婴儿闹夜有什么好办法(婴儿闹夜有什么好办法缓解) 如何重新激活淘宝店铺及发布宝贝(如何重新激活淘宝店铺及发布宝贝的权限) 冲锋衣如何选购全攻略(冲锋衣购买指南) 蓝色生死恋演员表恩熙小时候(蓝色生死恋演员表) QQ如何打开电台随机播放(QQ音乐怎么开电台) 如何怎么下载安装steam平台(steam平台游戏安装教程) 大地保险车险报案电话(大地保险车险怎么样) 武昌鱼清蒸的做法(武昌鱼清蒸的做法几分钟) 常用的招聘网站有哪些(现在招聘都用什么网站) 雨爱吉他谱弹唱原版(雨爱吉他谱简单版) 海带打结的作用(海带打结的作用原理) 电脑怎么制作表格新手 初学者(怎样制作表格) 暴走英雄坛丐帮入门任务攻略流程(暴走英雄坛丐帮入门任务攻略流程视频) 最简单的iPhone铃声设置方法(iphone铃声怎样设置) 如何做好一个保险律师(如何做好一个保险律师助理) 手阅怎么进行提现账号设置(掌阅能提现吗) 联想A366T获取Root权限详细图文教程 一个人笔仙游戏怎么玩(笔仙游戏怎么玩图片) 手动蝶阀怎么看开关(手动蝶阀怎么看开关工具) 如何下载【武林外传】(武林外传在哪里可以免费下载) 烫金字怎么做(烫金字) 如何让茶楼加盟店生意更好?(如何让茶楼加盟店生意更好些) 如何判断qq是否隐身(怎么看QQ是否隐身) 80平米两室一厅装修(8度) 瓷砖的色彩应该如何搭配?(瓷砖的色彩应该如何搭配好看) 微观经济学的定义是什么(微观经济学的定义) 书包背带怎么系(书包背带怎么系不会掉) 研究发现与巴顿病有关的蛋白质对于产生新的溶酶体至关重要 研究人员开发了一种新型抗炎药 NLRP1 和 NLRP3 炎症小体抑制剂 声明概述了心脏肿瘤护理和研究方面的不平等 全心全意为人民服务(全心全意) 360手机助手怎么下载(360手机助手怎么下载软件到电脑) 怀孕期间使用 THC 与胎儿发育的变化有关 研究发现空气质量差会以多种方式影响心理健康 研究揭示了后来患上幼年特发性关节炎的儿童肠道细菌的差异 研究证明微生物群移植疗法对干细胞移植和白血病患者的安全性 热量:人体能承受多少热量 了解甲型 乙型 丙型 丁型和戊型肝炎之间的区别 蜱虫季节即将开始 它们出现在新的地方 怎么做松鼠桂鱼 汉语拼音的音节是什么(汉语拼音中什么叫音节) qq如何查看我的勋章墙(怎么看qq我的勋章墙) 牡丹鹦鹉的主要食物有哪些?(牡丹鹦鹉的主要食物有哪些呢) 求发财路子(求发财之路) 怎么在sci上发表文章(怎么能发表sci)
您的位置:首页 >综合知识 >

语音识别系统的原理是什么?

导读 关于语音识别系统的原理是什么?这个问题很多朋友还不知道,今天小六来为大家解答以上的问题,现在让我们一起来看看吧!1、我们可以设想,

关于语音识别系统的原理是什么?这个问题很多朋友还不知道,今天小六来为大家解答以上的问题,现在让我们一起来看看吧!

1、我们可以设想,在不久的将来坐在办公司里的经理会对电脑说:“嗨!伙计,帮我通知一下公司所有员工,今天下午3:00准时开会。

2、”这是科学家在几十年前的设想,语音识别长久以来一直是人们的美好愿望,让计算机领会人所说的话,实现人机对话是发展人机通信的主要目标。

3、进入2l世纪,随着计算机的日益普及,怎样给不熟悉计算机的人提供一个友好而又简易的操作平台,是我们非常感兴趣的问题,而语音识别技术就是其中最直接的方法之一。

4、  20世纪80年代中期以来,新技术的逐渐成熟和发展使语音识别技术有了实质性的进展,尤其是隐马尔可夫模型(HMM)的研究和广泛应用,推动了语音识别的迅速发展,同时,语音识别领域也正处在一个黄金开发的关键时期,各国的开发人员正在向特定人到非特定人,孤立词汇向连接词,小词汇量向大词汇量来扩展研究领域,可以毫不犹豫地说,语音识别会让计算机变得“善解人意”,许多事情将不再是“对牛弹琴”,最终用户的口述会取代鼠标,键盘这些传统输入设备,只需要用户的嘴和麦克风就能实现对计算机的绝对控制。

5、  隐马尔可夫模型HMM的引入  现在假定HMM是一个输出符号序列的统计模型,具有N个状态S1,S2⋯Sn,在一个周期内从一个状态转到另一个状态,每次转移时输出一个符号,转移到了哪个状态以及输出什么符号,分别由状态转移概率和转移时的输出概率来决定,由于只能观测到输出符号序列,不能观测到状态转移序列,因此成为隐藏的马尔可夫模型。

6、  2、语音识别的特点  语音识别的意思是将人说话的内容和意思转换为计算机可读的输入,例如按键、二进制编码或者字符序列等。

7、与说话人的识别不同,后者主要是识别和确认发出语音的人而非其中所包含的内容。

8、语音识别的目的就是让机器听懂人类口述的语言,包括了两方面的含义:第一是逐字逐句听懂而不是转化成书面的语言文字;第二是对作者简介:贾聪,中国地质大学机械与电子信息学院。

9、口述语言中所包含的命令或请求加以领会,做出正确回应,而不仅仅只是拘泥于所有词汇的正确转换。

10、  3、语音识别系统的工作流程  一般来说,一套完整的语音识别系统其工作过程分为7步:①对语音信号进行分析和处理,除去冗余信息。

11、②提取影响语音识别的关键信息和表达语言含义的特征信息。

12、③紧扣特征信息,用最小单元识别字词。

13、④按照不同语言的各自语法,依照先后次序识别字词。

14、⑤把前后意思当作辅助识别条件,有利于分析和识别。

15、⑥按照语义分析,给关键信息划分段落,取出所识别出的字词并连接起来,同时根据语句意思调整句子构成。

16、⑦结合语义,仔细分析上下文的相互联系,对当前正在处理的语句进行适当修正。

17、  4、音识别系统基本原理框图及原理  语音识别系统基本原理结构如图1所示。

18、语音识别原理有三点:①对语音信号中的语言信息编码是按照幅度谱的时间变化来进行;②由于语音是可以阅读的,也就是说声学信号可以在不考虑说话人说话传达的信息内容的前提下用多个具有区别性的、离散的符号来表示;③语音的交互是一个认知过程,所以绝对不能与语法、语义和用语规范等方面分裂开来。

19、  预处理,其中就包括对语音信号进行采样、克服混叠滤波、去除部分由个体发音的差异和环境引起的噪声影响,此外还会考虑到语音识别基本单元的选取和端点检测问题。

20、反复训练是在识别之前通过让说话人多次重复语音,从原始语音信号样本中去除冗余信息,保留关键信息,再按照一定规则对数据加以整理,构成模式库。

21、再者是模式匹配,它是整个语音识别系统的核心部分,是根据一定规则以及计算输入特征与库存模式之间的相似度,进而判断出输入语音的意思。

22、  前端处理,先对原始语音信号进行处理,再进行特征提取,消除噪声和不同说话人的发音差异带来的影响,使处理后的信号能够更完整地反映语音的本质特征提取,消除噪声和不同说话人的发音差异带来的影响,使处理后的信号能够更完整地反映语音的本质特征。

23、  5、当前亟待解决的问题  语音识别系统的性能受到许多因素的影响,包括不同说话人的发音方式、说话方式、环境噪音、传输信道衰落等等。

24、具体要解决的问题有四点:①增强系统的鲁棒性,也就是说如果条件状况变得与训练时很不相同,系统的性能下降不能是突变的。

25、②增加系统的适应能力,系统要能稳定连续的适应条件的变化,因为说话人存在着年龄、性别、口音、语速、语音强度、发音习惯等方面的差异。

26、所以,系统应该有能力排除掉这些差异。

27、达到对语音的稳定识别。

28、③寻求更好的语言模型,系统应该在语言模型中得到尽可能多的约束,从而解决由于词汇量增长所带来的影响。

29、④进行动力学建模,语音识别系统提前假定片段和单词是相互独立的,但实际上词汇和音素的线索要求对反映了发声器官运动模型特点的整合。

30、所以,应该进行动力学建模,从而将这些信息整合到语音识别系统中去。

31、  6、统的组成和分类  根据识别的对象不同语音识别大致上可分为3类:对孤立词识别,对关键词识别和对连续语音识别。

32、其中,孤立词识别的任务是识别事先已知的孤立的词;连续语音识别的任务则是识别任意的连续语音;连续语音流中的关键词检测针对的是连续语音,但它并不识别全③部文字,而只是检测已知的若干关键词在何处出现,根据针对的发音人,可以把语音识别技术分为特定人语音识别和非特定人语音识别,前者只能识别一个或几个人的语音,而后者则可以被任何人使用。

33、  7、语音识别技术应用领域及前景展望  语音识别技术借助飞速发展的高速信息网,可实现计算机的全球联网和信息资源共享,因此被广泛应用的系统有:语音输入和控制系统,语音拨号系统、智能家电及玩具,智能电话查询系统,数据库检索等方面,在咨询服务、教育等行业,正潜移默化地改变和便利着我们的生活。

34、此外,语音识别系统还在多媒体手机、个人掌上电脑、车载导航器GPS等方面有着巨大的应用和市场前景。

35、  8、结语  语音识别是非常有发展潜力的一门学科,你可以设想。

36、我们平时生活中很多地方都可以用到它,可以大大便利我们的生活和工作,比如智能手机,智能空调及冰箱,电动门,汽车导航,机器人控制,医疗设施,军事设备等。

37、可以毫不夸张的说,21世纪将会是语音识别广泛流行和普及的时代,而语音识别产品和设备也会以其独特的魅力引领时代潮流,成为时代追逐的宠儿和焦点。

本文分享完毕,希望对大家有所帮助。

标签:

免责声明:本文由用户上传,如有侵权请联系删除!

最新文章