[发明专利]一种复杂中文文本中的实体消歧方法有效
申请号: | 202110603755.0 | 申请日: | 2021-05-31 |
公开(公告)号: | CN113283236B | 公开(公告)日: | 2022-07-19 |
发明(设计)人: | 王玉龙;王闯;刘同存;王纯;张乐剑;王晶 | 申请(专利权)人: | 北京邮电大学 |
主分类号: | G06F40/279 | 分类号: | G06F40/279;G06F40/216;G06F40/30;G06N3/04;G06N3/08 |
代理公司: | 暂无信息 | 代理人: | 暂无信息 |
地址: | 100876 *** | 国省代码: | 北京;11 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 一种复杂中文文本中的实体消歧方法,包括:从待消歧中文文本中提取所有待消歧实体指称;采用实体检索技术,从实体知识库中为每个待消歧实体指称选取若干个实体作为预候选实体,然后计算每个待消歧实体指称和每个预候选实体的第一相似度,并根据第一相似度挑选若干个实体作为候选实体;计算每个待消歧实体指称和每个候选实体的消歧相似度,并判断每个待消歧实体指称和所有候选实体的消歧相似度的最大值是否大于消歧相似度阈值,如果是,则待消歧实体指称是可链接实体,将待消歧实体指称链接至实体知识库中消歧相似度最大值对应的候选实体。本发明属于信息技术领域,能有效解决复杂中文文本领域的实体歧义问题,并提高实体召回率和实体链接准确率。 | ||
搜索关键词: | 一种 复杂 中文 文本 中的 实体 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于北京邮电大学,未经北京邮电大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202110603755.0/,转载请声明来源钻瓜专利网。
- 上一篇:一种可回吸乳液的乳液瓶
- 下一篇:文件导出方法、装置及计算机可读介质