cps实验室
AI科普在线
AI科普在线

您当前的位置: 首页 >>AI科普在线 >>正文

人工智能应用:语音识别技术科普
2020-09-18 21:13     (点击: )

    常用到的语音识别可能就是Siri或是智能音箱,因智能家居系统现在我国的使用还不够普及化,故这方面技术的应用具有很大的发展空间。下面,跟大家科普一下语音识别技术吧!

 

语音识别技术科普:

语音识别系统本质上是一种模式识别系统,包括特征提取、模式匹配、参考模式库等三个基本单元。

未知语音经过话筒变换成电信号后加在识别系统的输入端,首先经过预处理,再根据人的语音特点建立语音模型,对输入的语音信号进行分析,并抽取所需的特征,在此基础上建立语音识别所需的模板。而计算机在识别过程中要根据语音识别的模型,将计算机中存放的语音模板与输入的语音信号的特征进行比较,根据一定的搜索和匹配策略,找出一系列最优的与输入语音匹配的模板。然后根据此模板的定义,通过查表就可以给出计算机的识别结果。显然,这种最优的结果与特征的选择、语音模型的好坏、模板是否准确都有直接的关系。

语音识别系统构建过程整体上包括两大部分:训练和识别。

训练通常是离线完成的,对预先收集好的海量语音、语言数据库进行信号处理和知识挖掘,获取语音识别系统所需要的“声学模型”和“语言模型”;而识别过程通常是在线完成的,对用户实时的语音进行自动识别。

识别过程通常又可以分为“前端”和“后端”两大模块:“前端”模块主要的作用是进行端点检测(去除多余的静音和非说话声)、降噪、特征提取等;“后端”模块的作用是利用训练好的“声学模型”和“语言模型”对用户说话的特征向量进行统计模式识别(又称“解码”),得到其包含的文字信息,此外,后端模块还存在一个“自适应”的反馈模块,可以对用户的语音进行自学习,从而对“声学模型”和“语音模型”进行必要的“校正”,进一步提高识别的准确率。

语音识别是模式识别的一个分支,又从属于信号处理科学领域,同时与语音学、语言学、数理统计及神经生物学等学科有非常密切的关系。语音识别的目的就是让机器“听懂”人类口述的语言,包括了两方面的含义:其一是逐字逐句听懂转化成书面语言文字;其二是对口述语言中所包含的要求或询问加以理解,做出正确响应,而不拘泥于所有词的正确转换。

 

自动语音识别技术有三个基本原理:

 

首先语音信号中的语言信息是按照短时幅度谱的时间变化模式来编码;

其次语音是可以阅读的,即它的声学信号可以在不考虑说话人试图传达的信息内容的情况下用数十个具有区别性的、离散的符号来表示;

第三语音交互是一个认知过程,因而不能与语言的语法、语义和语用结构割裂开来。

目前,我国的语音识别技术有了很大的进步,识别的准确率也在逐步的提高。而我们

 

以上就是语音识别技术科普的全部内容。语音识别系统可以将我们的语言转变为相应的命令传递给智能机器人,随之完成相应的动作,它对人工智能有着至关重要的作用。

文章转自:

[1] 语音识别技术科普[DB/OL]. http://www.qianjia.com/html/2020-01/06_359237.html,2020-01-06

关闭窗口