[发明专利]一种基于知识蒸馏和PU学习的实体抽取采样方法在审
申请号: | 202110704680.5 | 申请日: | 2021-06-24 |
公开(公告)号: | CN113420548A | 公开(公告)日: | 2021-09-21 |
发明(设计)人: | 康文涛;傅啸;毛佳豪;周春珂;邱雨菲 | 申请(专利权)人: | 杭州电子科技大学 |
主分类号: | G06F40/279 | 分类号: | G06F40/279;G06F16/35;G06F40/237;G06K9/62;G06N3/04;G06N3/08 |
代理公司: | 杭州君度专利代理事务所(特殊普通合伙) 33240 | 代理人: | 朱月芬 |
地址: | 310018 浙*** | 国省代码: | 浙江;33 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明公开了一种基于知识蒸馏和PU学习的实体抽取采样方法,首先获取互联网语料库,经并将其整理得到文本,实体格式的数据集;然后对训练集数据进行预处理,构建教师网络,生成训练集的候选实体集D1;再构建PU学习分类器,生成训练集的候选实体集D2;构建学生网络训练样本集;最后进行学生网络模型训练,使用训练好的学生网络模型进行预测。本发明通过知识蒸馏,将多个模型的知识压缩到单一神经网络的训练采样过程中,并辅以PU学习分类器,保证了知识的准确性。在实体数据漏标严重的情况下,本发明能够有效减少样本集中的噪音数据,降低漏标实体数据对抽取结果的影响,改善抽取效果。 | ||
搜索关键词: | 一种 基于 知识 蒸馏 pu 学习 实体 抽取 采样 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于杭州电子科技大学,未经杭州电子科技大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202110704680.5/,转载请声明来源钻瓜专利网。