[发明专利]基于SE-ResNet STARGAN的多对多说话人转换方法在审
申请号: | 202010168943.0 | 申请日: | 2020-03-12 |
公开(公告)号: | CN111429894A | 公开(公告)日: | 2020-07-17 |
发明(设计)人: | 李燕萍;曹盼;何铮韬 | 申请(专利权)人: | 南京邮电大学 |
主分类号: | G10L15/08 | 分类号: | G10L15/08;G10L15/16;G10L15/18;G10L15/06 |
代理公司: | 南京苏高专利商标事务所(普通合伙) 32204 | 代理人: | 刘文闻 |
地址: | 210003 *** | 国省代码: | 江苏;32 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明公开了一种基于SE‑ResNet STARGAN的多对多说话人转换方法,基于STARGAN与SE‑ResNet相结合来实现语音转换系统,在残差网络基础上,引入注意力思想和门控机制对各通道的依赖性进行建模,通过全局信息学习每个特征通道的权重,并对特征进行逐通道调整,有选择性地强化有用特征同时抑制无用特征,进一步增强模型的表征能力,同时能够有效解决训练过程中存在的网络退化问题,较好地提升模型对语音频谱的语义的学习能力以及语音频谱的合成能力,从而改善转换后语音的个性相似度和合成质量,实现了一种非平行文本条件下的高质量的多对多语音转换方法。 | ||
搜索关键词: | 基于 se resnet stargan 说话 转换 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于南京邮电大学,未经南京邮电大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202010168943.0/,转载请声明来源钻瓜专利网。