[发明专利]基于Bi-LSTM-CRF的三位一体字标注汉语词法分析方法在审
申请号: | 202011204830.8 | 申请日: | 2020-11-02 |
公开(公告)号: | CN112364623A | 公开(公告)日: | 2021-02-12 |
发明(设计)人: | 于江德;胡顺义;王希杰;谷川;赵红丹 | 申请(专利权)人: | 安阳师范学院 |
主分类号: | G06F40/211 | 分类号: | G06F40/211;G06F40/284;G06F40/295;G06N3/04;G06N3/08 |
代理公司: | 河南银隆律师事务所 41186 | 代理人: | 刘一闯 |
地址: | 455000 河南*** | 国省代码: | 河南;41 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明属于词法分析技术领域,公开了基于Bi‑LSTM‑CRF的三位一体字标注汉语词法分析方法,基于三位一体字标注汉语词法分析的思路构建模型的训练语料和测试语料;搭建Bi‑LSTM‑CRF模型;输入训练语料通过多次迭代训练Bi‑LSTM‑CRF模型;切分输入的汉语文本,并将其输入训练好的模型;确定输入汉语文本最终的词法信息标记序列;依据词法信息标记序列对输入文本进行汉语分词、汉语词性标注和汉语命名实体识别,获得最终的汉语词法分析结果。本发明免去采用传统机器学习建模的人工特征工程,将表示学习方法引入机器学习中,可以将特征表示、提取、选择交给模型自动完成,提升了效率,提高了汉语词法分析的精度。 | ||
搜索关键词: | 基于 bi lstm crf 三位一体 标注 汉语 词法 分析 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于安阳师范学院,未经安阳师范学院许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202011204830.8/,转载请声明来源钻瓜专利网。