[发明专利]一种改进的端到端语音识别方法有效
申请号: | 201911273709.8 | 申请日: | 2019-12-12 |
公开(公告)号: | CN111048082B | 公开(公告)日: | 2022-09-06 |
发明(设计)人: | 严勇杰;邓科;陈平;王煊 | 申请(专利权)人: | 中国电子科技集团公司第二十八研究所 |
主分类号: | G10L15/22 | 分类号: | G10L15/22;G10L15/183;G10L15/16;G10L15/06 |
代理公司: | 江苏圣典律师事务所 32237 | 代理人: | 胡建华;于瀚文 |
地址: | 210007 *** | 国省代码: | 江苏;32 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明提供了一种改进的端到端语音识别方法,该方法结合卷积神经网络和自注意力机制,利用CTC训练准则训练端到端的语音识别模型,模型主要由三部分组成:(1)深度二维卷积部分;(2)自注意力部分;(3)全连接层;该模型第一部分通过二维卷积有效提取语音信号时间轴和频域轴的特征,具有平移不变性,第二部分利用自注意力机制使得语音信号能够充分结合上下文,第三部分则将每帧语音特征进行分类,最后利用CTC训练准则更新模型参数。该模型创新性地将自注意力机制加入到神经网络‑CTC框架中,实现了端到端的语音识别,并使得识别效果得到改善。 | ||
搜索关键词: | 一种 改进 端到端 语音 识别 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于中国电子科技集团公司第二十八研究所,未经中国电子科技集团公司第二十八研究所许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/201911273709.8/,转载请声明来源钻瓜专利网。