[发明专利]一种基于最大池化自注意力机制的声纹识别方法及系统在审
| 申请号: | 202211733131.1 | 申请日: | 2022-12-30 |
| 公开(公告)号: | CN116072127A | 公开(公告)日: | 2023-05-05 |
| 发明(设计)人: | 孙钢;沈然;沈皓;李伊玲;汪一帆;徐世予;章江铭;章一新;项莹洁;佘清顺 | 申请(专利权)人: | 国网浙江省电力有限公司营销服务中心;浙江大学 |
| 主分类号: | G10L17/18 | 分类号: | G10L17/18;G10L17/04;G10L17/02 |
| 代理公司: | 浙江翔隆专利事务所(普通合伙) 33206 | 代理人: | 张建青 |
| 地址: | 311100 浙江*** | 国省代码: | 浙江;33 |
| 权利要求书: | 查看更多 | 说明书: | 查看更多 |
| 摘要: | 本发明公开了一种基于最大池化自注意力机制的声纹识别方法及系统。本发明的方法包含如下步骤:提取音频特征序列;使用卷积神经网络对音频特征序列进行降采样处理;使用基于最大池化自注意力机制的Transformer编码器进行训练;对Tranformer编码器的输出进行正则化;使用统计注意力聚合的方法提取说话人声纹编码;使用角度原型损失函数最小化训练损失。相比于传统Transformer进行声纹识别,本发明对Transformer的自注意力机制做了改进,在相似度矩阵中引入最大池化操作,提高自注意力机制对局部信息的建模能力;本发明较原始Transformer更适合进行声纹识别,准确率更高。 | ||
| 搜索关键词: | 一种 基于 最大 注意力 机制 声纹 识别 方法 系统 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于国网浙江省电力有限公司营销服务中心;浙江大学,未经国网浙江省电力有限公司营销服务中心;浙江大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202211733131.1/,转载请声明来源钻瓜专利网。





