CN119399770A 一种健康大数据智能管理方法及系统 (北京大学)_第1页
CN119399770A 一种健康大数据智能管理方法及系统 (北京大学)_第2页
CN119399770A 一种健康大数据智能管理方法及系统 (北京大学)_第3页
CN119399770A 一种健康大数据智能管理方法及系统 (北京大学)_第4页
CN119399770A 一种健康大数据智能管理方法及系统 (北京大学)_第5页
已阅读5页,还剩22页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

确定候选文字组作为句子的识别结果的可能程识别精确度最大的候选文字组中的候选文字为2将各所述字符的候选文字进行组合,得到所述句子的候选文字组,所根据所述候选文字组中的候选文字与对应字符的相似度,确定所述根据所述候选文字组中候选文字组成的词汇在健康大数据系统的数据库中出现的次选取识别精确度最大的候选文字组中的候选文字为所述句子的识别将所述候选文字组中各所述候选文字与对应字符的相似分别将所述候选文字组中相邻的三个候选文字针对每个所述候选文字集合,分别将所述候选文字集合中的前两根据所述第一词汇、所述第二词汇以及所述第三词汇在所述数据根据所述候选文字集合的合理程度,确定所述候选文字组中的候选计算所述第一词汇在所述数据库中出现的第一次数、所根据所述第一乘积和所述第二乘积确定所述候选文字集合的3确定所述可能程度和所述综合合理程度的乘积为所基于OCR识别算法对所述句子中的字符进行确定与所述字符相似度大于阈值的文字为所述存储器上所存放的程序,实现如权利要求1_9任意一项所述的健康大数据智能管理方法的4[0001]本发明涉及健康信息学技术领域,具体涉及一种健康大数据智能管理方法及系[0004]为了解决OCR技术识别处方图像中处方内容的准确率较低的技术问题,本发明的为句子的识别结果的可能程度包括:将候选文字组中各候选文字与对应字符的相似度相5根据第一乘积和第二乘积确定候选文字集合的度;其次根据候选文字组中候选文字组成的词汇在健康大数据系统的数据库中出现的次选取识别精确度最大的候选文字组中的候选文字为句子的识别得到候选文字组并按照候选文字组中的候选文字与对应字符的相似度确定其作为句子的6图3为本发明一个实施例所提供的另一种健康大数据智能管理系统的结构示意[0020]下面结合附图具体地说明本发明所提供的一种健康大数据智能管理方法的具体请参阅图1,其示出了本发明一个实施例提供的健康大数据智能管理方法的流程7[0028]进一步的,字符与候选文字的相似度可以直接表示该字符属于某个文字的可能OCR识别算法对句子中的字符进行识别;确定与字符相似度大于阈值的文字为字符的候选文字,则该段第句话中各字符的候选文字组合的候选文字组共有话的第1个字符选择第1个字符的第个候选文字、第2个字符选择第2个字符的第ia个候8m个字符的第in个候选文字。应的候选文字的相似度的乘积可以作为该句子中所有字符作为该句子的识别结果的准确中各候选文字的组合作为句子的识别结果的可能。则针对种情况中的第种可的计算公式如下:;直接反映了第k个字符选择其所有的候选文字中的第lk个候选文字作为该字符识别结果的选择其某一相似的候选文字的相似度进行连乘,表示该候选文字组中第1个字符选择其第9[0042]进一步的,综合合理程度指的是候选文字组中的候选文字的组合选取的合理程汇在数据库中出现的次数确定候选文字集合的合理程度;根据候选文字集合的合理程度,确定候选文字组中的候选文字作为句子的识别结果的综合先对某一候选文字组中的相邻的两到三个候选文候选文字组成一组候选文字集合,候选文字集合共m-2组,将每一候选文字集合记为,表示某候选文字组中相邻的字以及三个候选文字共同组成的词汇在健康大数据系统的数据库中记录的药品使用记录中出现的次数,分别记为。其中,QEZ表示其第z个候选文字集合中前两个候选文字组成的词汇在健康大数据系统的数据库中记录的个候选文字组成的词汇在健康大数据系统的数据库中记录的药品使用记录中出现的次数,S:表示其第z个候选文字集合中三个候选文字组成的词汇在健康大数据系统的数据库中记录的药品使用记录中出现的次;上式中,B表示第i个句子中其第Z个候选文字集合的合候选文字组成的词汇在健康大数据系统的数据库中记录的药品使用记录中出现的次数,表示对于第i个句子中其第z个候选文字集合中后两个候选文字组成的词汇在健康大数据系统的数据库中记录的药品使用记录中出现的次数,S:表示对于第i个句子中其第z个候选文字集合中三个候选文字组成的词汇在健康大数据系统的数据库中记录的药品使用记录中出现的次数。分别[0048]进一步的,表示两种两个候选文字的组合出现的[0050]具体来讲,对于第个句子中各字符选择的第[i,jz…jn种可能情况对应的候选文字组,综合其每个候选文字集合的合理程度计算的计算公式如下:;情况对应的候选文字组的综合合理程度,表示将各候选文字集合的合理程度明第i个句子中各字符选择的第种可能情况对应的候选文字组作为第i[0052]具体来讲,在得到第个句子中各字符选择的第种可能情况对应的候选文字组作为第个句子的识别结果的可能程度[0053]本申请实施例中,采用表示候选文字组中的候选文字作为句子的;的候选文字的情况下,将该情况对应的候选文字组合作[0055]具体来讲,分别计算第个句子候选文字组并按照候选文字组中的候选文字与对应字符的相似度确定其作为句子的识别实施例还提供了一种健康大数据智能管理系统,图2为本申请实施例提供的健康大数据智能管理系统的模块组成示意图,该健康大数据智能管理系统用于执行图1描述的健康大数数据库中出现的次数,确定候选文字组中的候选文字作为句子的识别结果的综合合理程[0064]可选的,确定模块202,还用于确定可能程度和综合合理程度的乘积为识别精确[0067]本申请实施例提供的健康大数据智能管理系统能够实现上述健康大数据智能管健康大数据智能管理方

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论