软件脉链app 卢司令app 智能屋z官方版 pep英语四年级电子课本鱼友汇官方版太原生活圈app

语音识别原理

更新时间：2024-05-17 04:36:03 来源：大39游戏网

首先，我们知道声音实际上是一种波。常见的mp3、wmv等格式都是压缩格式，必须转成非压缩的纯波形文件.........

　　首先，我们知道声音实际上是一种波。常见的mp3、wmv等格式都是压缩格式，必须转成非压缩的纯波形文件来处理，比如Windows PCM文件，也就是俗称的wav文件。wav文件里存储的除了一个文件头以外，就是声音波形的一个个点了。

　　在开始语音识别之前，有时需要把首尾端的静音切除，降低对后续步骤造成的干扰。这个静音切除的操作一般称为VAD，需要用到信号处理的一些技术。要对声音进行分析，需要对声音分帧，也就是把声音切开成一小段一小段，每小段称为一帧。分帧操作一般不是简单的切开，而是使用移动窗函数来实现，这里不详述。帧与帧之间一般是有交叠的。

　　每帧的长度为25毫秒，每两帧之间有25-10=15毫秒的交叠。我们称为以帧长25ms、帧移10ms分帧。每帧的长度为25毫秒，每两帧之间有25-10=15毫秒的交叠。我们称为以帧长25ms、帧移10ms分帧。

　　分帧后，语音就变成了很多小段。但波形在时域上几乎没有描述能力，因此必须将波形作变换。常见的一种变换方法是提取MFCC特征，根据人耳的生理特性，把每一帧波形变成一个多维向量，可以简单地理解为这个向量包含了这帧语音的内容信息。这个过程叫做声学特征提取。实际应用中，这一步有很多细节，声学特征也不止有MFCC这一种，具体这里不讲。

　　至此，声音就成了一个12行（假设声学特征是12维）、N列的一个矩阵，称之为观察序列，这里N为总帧数。观察序列如下图所示，图中，每一帧都用一个12维的向量表示，色块的颜色深浅表示向量值的大小。

　　接下来就要介绍怎样把这个矩阵变成文本了。首先要介绍两个概念：音素：单词的发音由音素构成。对英语，一种常用的音素集是卡内基梅隆大学的一套由39个音素构成的音素集，参见The CMU Pronouncing Dictionary。汉语一般直接用全部声母和韵母作为音素集，另外汉语识别还分有调无调，不详述。状态：这里理解成比音素更细致的语音单位就行啦。通常把一个音素划分成3个状态。

　　语音识别是怎么工作的呢？实际上一点都不神秘，无非是：第一步，把帧识别成状态（难点）；第二步，把状态组合成音素；第三步，把音素组合成单词。

本文标题：语音识别原理
本文永久链接：http://www.da39.com/shenghuo677886.html

the end

声明：大39游戏网稿件来源主要为网站原创、用户投稿、网络资源整理等。如果相关权益人认为本文侵犯您的权益，请备好权益证明、身份证明，及时联系QQ 1926491587 我们将会在48小时内给文章处理！

1 2 下一页

上一篇：遵义微信缴医保流程

下一篇：香菇是植物吗

科技列表

微信视频聊天能回看吗是视频聊天
微信视频聊天是不能回看的,只能实时播放对话。视频聊天的打开方法:1、我们打开微信后点击右上角的这三个...
2024-05-17
壁挂炉原理
1、壁挂炉原理：壁挂炉进入工作状态，风机先启动使燃烧室内形成负压差。风压开关把指令发给水泵，水泵启动...
2024-05-17
word抠有底色图章的正确方法
1、打开word文档，插入要进行抠图的图片。2、选中图片，依次单击“格式”-“删除背景”，打开“背景...
2024-05-17
今日头条极速版卡顿怎么回事
1、刷今日头条极速版的时候手机卡顿，有可能是因为手机打开应用太多的问题。解决方法如下：如果打开应用较...
2024-05-17
照片制作livephoto软件
1、打开“相机”软件，点击上方的“实况”按钮，点击后可以直接拍摄livephoto。2、拍摄完成后，...
2024-05-17
核潜艇是什么意思
1、核潜艇是潜艇中的一种类型，指以核反应堆为动力来源设计的潜艇。由于这种潜艇的生产与操作成本，加上相...
2024-05-17
世界上最快的计算机
1、截止到目前为止，最快的计算机是中国的天河二号。天河二号是天河一号的改良，天河二号超级计算机是中国...
2024-05-17
qq下载为什么打开不了
1、下载下来QQ了，但是你的手机系统版本太低了，就会出现打不开软件的问题，更新系统就好了。2、在下载...
2024-05-17
北斗三号在哪里发射成功
1、北斗三号在西昌卫星中心发射成功。北斗三号卫星导航系统由24颗中圆地球轨道卫星、3颗地球静止轨道卫...
2024-05-17
王者荣耀头像怎么换
1、如果王者荣耀是使用QQ登录的，头像就是QQ头像，所以只要修改QQ头像就能修改王者头像。2、打开手...
2024-05-17