[发明专利]基于多任务学习的中文拼写纠错方法有效
申请号: | 202210023934.1 | 申请日: | 2022-01-11 |
公开(公告)号: | CN114065738B | 公开(公告)日: | 2022-05-17 |
发明(设计)人: | 刘洋;刘酃威;林中尧 | 申请(专利权)人: | 湖南达德曼宁信息技术有限公司 |
主分类号: | G06F40/232 | 分类号: | G06F40/232;G06F40/166;G06F16/35 |
代理公司: | 长沙轩荣专利代理有限公司 43235 | 代理人: | 汪金连 |
地址: | 410000 湖南省长沙市雨*** | 国省代码: | 湖南;43 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明提供了一种基于多任务学习的中文拼写纠错方法,包括:步骤1,将样例句文本和标签句文本以特定格式输入文本编码模块,文本编码模块输出文本向量;步骤2,将文本向量中句子起始的标识符对应的向量输入正确句判别模块;步骤3,将文本向量中样例句对应的向量输入字级别多分类模块,字级别多分类模块将输出输入候选字生成模块的语义混淆集中。本发明提出了正确句判别任务,通过在训练过程中构建句子对,模型需要识别句子对中不含错误的句子,能够让模型具有基于句子级别分辨正确语句与错误语句的能力,同时和预训练模型的句子对顺序预测任务较好契合,更好的挖掘利用了预训练模型在拼写校对领域的能力,具备更好的识别正确句的能力。 | ||
搜索关键词: | 基于 任务 学习 中文 拼写 纠错 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于湖南达德曼宁信息技术有限公司,未经湖南达德曼宁信息技术有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202210023934.1/,转载请声明来源钻瓜专利网。