[发明专利]词语识别方法及装置有效
申请号: | 201210570618.2 | 申请日: | 2012-12-17 |
公开(公告)号: | CN103870822B | 公开(公告)日: | 2018-09-25 |
发明(设计)人: | 郑大念 | 申请(专利权)人: | 捷讯平和(北京)科技发展有限公司 |
主分类号: | G06K9/20 | 分类号: | G06K9/20 |
代理公司: | 上海隆天律师事务所 31282 | 代理人: | 臧云霄;钟宗 |
地址: | 100015 北京市朝阳*** | 国省代码: | 北京;11 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明的实施方式提供了一种词语识别方法,包括:对所述词语中的每个单字进行识别,并记录识别结果中置信度最高的前若干个识别的候选字及其对应的置信度;搜索每个常用词的各单字是否在所述词语的单字的候选字中出现,若出现,则记录该单字的在该常用词中的该候选字的置信度,若未出现,则将该字的置信度计为零;计算针对每个常用词的所述词语中各单字的平均置信度,作为该常用词的置信度;若置信度最高的常用词的置信度大于一阈值,则输出这个常用词作为该词语的识别结果,否则输出该词语的每个单字的置信度最高的候选字作为该词语的识别结果。通过使用常用词语的先验知识对词语进行识别,获得整个词语的置信度,降低了单个字识别的误差,提高了词语识别的准确率和效率。 | ||
搜索关键词: | 词语 识别 方法 装置 | ||
【主权项】:
1.一种词语识别方法,包括:S11:对词语中的每个单字进行识别,并分别记录识别结果中关于每个单字的置信度最高的前若干个识别的候选字及其对应的置信度;S12:搜索每个常用词的各单字是否在所述词语的单字的候选字中出现,若出现,则记录该单字的在该常用词中的该候选字的置信度,若未出现,则将该字的置信度计为零;S13:针对每个常用词,根据由步骤S12得到的该常用词中所有单字的置信度,计算该常用词中所有单字的置信度的均值,并将该均值作为该常用词的置信度;S14:若置信度最高的常用词的置信度大于一阈值,则输出这个常用词作为该词语的识别结果,否则输出该词语的每个单字的置信度最高的候选字作为该词语的识别结果。
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于捷讯平和(北京)科技发展有限公司,未经捷讯平和(北京)科技发展有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/201210570618.2/,转载请声明来源钻瓜专利网。