CN115203372B 文本意图分类方法、装置、计算机设备及存储介质 (平安科技(深圳)有限公司)_第1页
CN115203372B 文本意图分类方法、装置、计算机设备及存储介质 (平安科技(深圳)有限公司)_第2页
CN115203372B 文本意图分类方法、装置、计算机设备及存储介质 (平安科技(深圳)有限公司)_第3页
CN115203372B 文本意图分类方法、装置、计算机设备及存储介质 (平安科技(深圳)有限公司)_第4页
CN115203372B 文本意图分类方法、装置、计算机设备及存储介质 (平安科技(深圳)有限公司)_第5页
已阅读5页,还剩30页未读, 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

道福安社区益田路5033号平安金融中过通用意图簇和场景意图簇对文本意图簇进行2将所述目标语句文本输入至片段识别模型,通过所述片段识别模分别对所述第一片段识别结果、所述第二片段识别结果获取预设通用意图簇和预设场景意图簇,根据所述预设通用意图所述通过所述片段识别模型对所述目标语句文本进行片段识别通过所述片段识别模型中的编码模块对所述目标语句文本进行编码处理,通过所述片段识别模型中的变换模块对所述目标词向量进行变换处理获取目标位置向量,根据所述目标句向量和所述目标位置向量所述对所述第一片段识别结果、所述第二片段识别结果和所述第三将所述第一片段识别结果、所述第二片段识别结果和所述第本语义向量和第三片段识别结果对应的第三文基于聚类算法分别对所述文本语义向量进行聚类,得到第一片段识获取历史语句文本和所述历史语句文本对应的历史回复文本;对所述历史语句文本、所述历史回复文本和所述当前语句文本进行获取所述当前语句文本对应的当前文本标签,并对所述历史将所述初始文本和所述初始标签输入至预设文本查询模型,获取所述从所述初始文本中提取所述指代实体位置对应的指代实体文本,3对所述预设通用意图簇和各文本意图簇进行向量提取,得到预设通将表征匹配失败的意图分类结果对应的文本意图簇记录为对所述预设场景意图簇和各匹配意图簇进行向量提取,得到预设获取初始语句文本,对所述初始语句文本进行切词处理,得根据与各待处理字词相对应的实体识别结果,对所述初始语句文本识别模块,用于将所述目标语句文本输入至片段识别模型,通聚类模块,用于分别对所述第一片段识别结果、所述第对应的第二文本意图簇和第三片段识别结果对应的第三文结果模块,用于获取预设通用意图簇和预设场景意图簇,编码单元,用于通过所述片段识别模型中的编码模变换单元,用于通过所述片段识别模型中的变换模块对所述目标词向量进行变换处结果单元,用于获取目标位置向量,根据所述目标4语义向量单元,用于将所述第一片段识别结果、所述第二片段识别别结果对应的第二文本语义向量和第三片段识别结果对应的第三文7.一种计算机设备,包括存储器、处理器及8.一种计算机可读存储介质,所述计算机可读存储介质5文本意图簇和第三片段识别结果对应的第三文结果对应的第二文本意图簇和第三片段识别结果对应的第三6[0026]本发明实施例提供的文本意图分类方法,该文本意图分类方法可应用如图1所示7片段识别模型中不同的模块对目标语句文本进行处理。当目标语句文本符合主流程意图8[0040]S12,对所述历史语句文本、所述历史回复文本和所述当前语句文本进行文本拼9置为需要初始文本中需要补全的位置或指代词在初始文补全位置,从而实现了对初始文本中指代实体位置和当前语句文本中待补全位置的获取。字词的词性辅助确定每一待处理字词的实体类型,进而将实体类型确定为实体识别结果,[0059]S18,根据与各待处理字词相对应的实体识别结果,对所述初始语句文本进行过进行变换处理。当变换模块为transformerencoder时,将所有目标词向量输入到例的变换过程为给每个分词结果的目标词向量添加位置编码positionalencoding。再将码positionalencoding,将目标句向量和目标位置向量作为输入经过三层transformer[0073]进一步地,本实施例中通过在transformerencoder中位置编码通过使用不同频[0074]本发明实施例通过片段识别模型中的编码模块对所述目标语句文本进行编码处的第二文本语义向量和第三片段识别结果对应的第三[0077]可理解地,预设编码模型为提前设置的用于将片段识别义流程意图的片段识别结果和表征结束流程意图的片段识别结果输入到预设编码模型中,目标语句文本S,通过BERT模型中的组件对目标语句文本进行分词处理,得到S=[CLS,片段识别结果对应的第二文本意图簇和第三片段识别结果对应的第三的文本语义向量分为K组,并随机选取N个(N小于等于K)文本语义向量作为初始的聚类中最小数目)对象被重新分配给不同的聚类,也可以是没有(或最小数目)聚类中心再发生变[0084]本发明实施例通过预设编码模型对与片段识别结果相对应的目标语句文本进行对应的通用语义向量和各文本意图簇对应的意图簇和第三文本意图簇中的关键词或关键句进行提取,再对关键词或关键句进行向量过TextRank算法进行关键词或关键句提取以及通过梅尔频率倒谱系数进行特征提取属于[0089]S42,将所述通用语义向量和所有所述文本语义向量进行匹配,得到通用分类结语义向量和通用语义向量之间的余弦值是否超过语义向量为预设场景意图簇的中心语义向量。匹配语义向量为匹配意图簇的中心语义向键词作为该匹配意图簇和预设场景意图簇的意图标签,得到匹配意图标签和场景意图标匹配语义向量输入到预设匹配模型(如RE2模型)中,通过预设匹配模型计算各场景语义向断欧式距离(或余弦相似度)是否超过预设的阈值,确定匹配意图簇是否记录为场景意图[0100]本发明实施例通过将与表征匹配失败的意图匹配结果相对应的文本意图簇确定别结果对应的第二文本意图簇和第三片段识别结果对应[0111]补全单元,用于从所述初始文本中提取所述指代实体位段识别结果对应的第二文本语义向量和第三片段识别结果对应的第三文通用意图簇对应的通用语义向量和各文本意图簇对应的文[0129]关于文本意图分类装置的具体限定可以参见上文中对于文本意图分类方法的限机程序被处理器执行时实现上述实施例中文本意包括非易失性和/或易失性存储器。非易失性存储器可包括只读存储器(ROM)、可编程ROM型SDRAM(ESDRA

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论