[发明专利]一种文字语义分析方法、文字语义分析终端及存储介质有效

专利信息
申请号: 201710995052.0 申请日: 2017-10-23
公开(公告)号: CN107704453B 公开(公告)日: 2021-10-08
发明(设计)人: 胡明灯 申请(专利权)人: 深圳市前海众兴科研有限公司
主分类号: G06F40/30 分类号: G06F40/30;G06F40/253;G06F40/289;G06F16/383
代理公司: 深圳市徽正知识产权代理有限公司 44405 代理人: 卢杏艳
地址: 518000 广东省深圳市前海深港合作区前*** 国省代码: 广东;44
权利要求书: 查看更多 说明书: 查看更多
摘要:
搜索关键词: 一种 文字 语义 分析 方法 终端 存储 介质
【说明书】:

发明提供了一种文字语义分析方法、文字语义分析终端及存储介质,通过接收用户输入的文字信息,将所述文字信息中包含的字符串分隔成独立的单词,得到单词序列;对分隔出的单词序列进行语法分析,判断所述单词序列中是否存在语法错误;将单词序列中含有的单词转化成相对应的元数据,计算各个元数据之间的语义相似度和特征项权重,并提取所述单词序列的关键词特征项,得到各个单词所对应的语义标记文本,建立文本数据库,按照单词序列中各个单词的排列顺序,依次从文本数据库中匹配出语义标记文本,并将排序后合成的文本信息输出显示。本发明通过元数据的格式反馈给用户,从而方便用户获取语义分析终端反馈过来的信息,正确理解和使用信息。

技术领域

本发明涉及语义分析技术领域,尤其涉及一种文字语义分析方法、文字语义分析终端及存储介质。

背景技术

目前人机之间的交互方式还是采用文字对话方式,信息采集和过滤达不到预期想要的目的,无法准确识别出当前用户所说出话的含义,比如说“后海可以吗?”,但机器却可以理解为“后海不在家”这样的意思,而我们用户的意思是说“我们去后海那边吃饭可以吗?”,虽然采用的都是文字类型的会话,但人类所表达的意义可以是千变万化的,这种文字会话的语义分析方法存在以下诸多不便:

首先,一般情况下,用户所表达的含义富含人类独特的情感在里面,如果采用这种简单的文字会话语义分析方法,机器是没法做到识别出用户真正想表达的意思;其实,即使机器可能识别出了用户的大部分意思,但是通过机器一转述,可能表达的意思又不一样;第三,如果人机之间的会话都是这种简单的文字会话,没有对数据进行加密、抽样分析、输出加密,则信息的安全性得不到保障,很容易别有心思的人或黑客破解获取,不利于数据信息的传递。

因此,现有技术需要进一步的改进。

发明内容

针对上述技术问题,本发明实施例提供了一种文字语义分析方法、文字语义分析终端及存储介质,以旨在帮助现有人机会话无法识别用户所表述的信息真实的含义,解决信息传递错误的问题。

本发明实施例的第一方面提供一种文字语义分析方法,所述文字语义分析方法包括以下步骤:

接收用户输入的文字信息,并对输入的所述文字信息进行词法分析,将所述文字信息中包含的字符串分隔成独立的单词,得到单词序列;

对分隔出的单词序列进行语法分析,判断所述单词序列中是否存在语法错误,并将存在语法错误的单词或相邻单词组成的词组过滤掉;

将单词序列中含有的单词转化成相对应的元数据,计算各个元数据之间的语义相似度和特征项权重,并根据计算出的语义相似度和特征项权重提取所述单词序列的关键词特征项,并根据所述关键词特征项得到各个单词所对应的语义标记文本,并将所述语义标记文本存储在文本数据库;

按照单词序列中各个单词的排列顺序,依次从所述文本数据库中匹配出对应的语义标记文本,并将排序后合成的文本信息输出显示。

可选地,所述用户输入的文字信息包括:用户的身份信息和用户输入的问题信息;

所述用户的身份信息包括:用户ID信息字节、用户姓名字节、手机号码字节。

可选地,所述将所述文字信息中包含的字符串分隔成独立的单词的步骤包括:

使用空格作为分隔符,将所述文字信息中包含的字符串分隔成独立的单词,并为每个单词设置唯一对应的编号标识和下一个元数据的指向标识。

可选地,接收用户输入的文字信息之前还包括:

创建用于存储元数据的元数据库,并且建立单词目录与元数据库中所含元数据之间的关联关系;

在所述将单词序列中含有的单词转化成相对应的元数据的步骤中,通过所述关联关系,查找出所述单词所对应的元数据。

下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。

该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于深圳市前海众兴科研有限公司,未经深圳市前海众兴科研有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服

本文链接:http://www.vipzhuanli.com/pat/books/201710995052.0/2.html,转载请声明来源钻瓜专利网。

×

专利文献下载

说明:

1、专利原文基于中国国家知识产权局专利说明书;

2、支持发明专利 、实用新型专利、外观设计专利(升级中);

3、专利数据每周两次同步更新,支持Adobe PDF格式;

4、内容包括专利技术的结构示意图流程工艺图技术构造图

5、已全新升级为极速版,下载速度显著提升!欢迎使用!

请您登陆后,进行下载,点击【登陆】 【注册】

关于我们 寻求报道 投稿须知 广告合作 版权声明 网站地图 友情链接 企业标识 联系我们

钻瓜专利网在线咨询

周一至周五 9:00-18:00

咨询在线客服咨询在线客服
tel code back_top