本发明公开了一种用于图像文字的语义识别系统及方法,涉及智能识别技术领域,包括管控模块,所述管控模块连接有数据库、数据采集模块、方向校正模块、语义识别模块和预警模块;所述数据库用于存储词语的特征值、词语的语义、用户反馈的识别错误记录和无法识别记录;所述数据采集模块用于获取需要待识别词语,并根据获取的待识别词语生成相应的预警信号;所述方向校正模块用于对待识别词语进行方向校正;所述语义识别模块用于对待识别词语进行语义识别,并在识别过程中生成相应的预警信号;所述预警模块用于处理预警信号;本系统通过方向校正模块对待识别词语进行方向校正,使得后续的语义识别更具有准确性。
📄 2024114357802
📂 G06V30_413
👤 合肥问道文化传播有限公司
📅 2024-10-15
本发明涉及基于注意力修正的图神经网络的视觉文档信息抽取方法,包括先依据实体及其文本内容与文本框信息提取实体节点图像、文本、布局特征,获取文档中各实体节点相邻最近的n个实体节点索引以生成边邻接矩阵,后将实体节点特征与边邻接矩阵输入GraphSAGE图网络模型学习节点特征,此过程融合图卷积与基于结构特征的注意力修正机制,依据节点特征距离与度信息计算并修正边权重,经多层图卷积与修正操作后输出特征表示,输入全连接层完成节点分类,对文档采样获取实体节点对及边特征,融合后再输入全连接层进行边分类。该方法借助GraphSAGE模型,有效融合多模态信息,精准捕捉节点与图结构特性,动态调整节点关系与权重,显著提升实体节点分类准确率。
📄 202411964079X
📂 G06V30_413
👤 杭州电子科技大学
📅 2024-12-30
本发明提供了一种图像骨架节点特征描述符获取方法及装置。其中方法包括步骤S1,提取输入图像的骨架线,获得主要色块骨架线像素点和次要色块骨架线像素点;S2,提取骨架线的笔画线段的笔画线型;S3,确定骨架线的笔画线段的节点数据,节点包括:端点、折点;S4,对节点数据进行编码,按照预设的节点排列顺序规则对节点编码进行排序组合,将排序组合的结果作为图像骨架节点特征描述符。装置包括获取模块、提取模块、确定模块、生成模块。该方法及装置可有效克服使用传统方法提取图像骨架线易导致相同或近似的图像的图像共同性特征描述错误、文字图像骨架线笔划与文字本身的笔划不对应、相同文字图像检索时造成图像骨架特征匹配困难的问题。
📄 2020100573742
📂 G06V30_413
👤 徐庆,佛山市国方识别科技有限公司
📅 2020-01-19
本发明提供一种文档图像的区域分离方法、装置及存储介质。通过对文档图像进行预处理得到二值化图像,对二值化图像进行连通区域分析得到第一连通区域集合,根据第一连通区域集合中各连通区域的属性特征,将第一连通区域集合划分为第二连通区域集合和第三连通区域集合,其中第二连通区域集合中包括非文本元素的连通区域,第三连通区域集合中包括文本元素的连通区域,进一步根据第三连通区域集合中各连通区域的属性特征和相邻位置信息,从第三连通区域集合中确定文本元素的连通区域。上述方法可以从文本区域中提取更多的非文本元素,提高了文档图像的文本非文本分离的准确性。
📄 2019110083357
📂 G06V30_413
👤 广州高航技术转移有限公司
📅 2019-10-22
本发明公开了一种基于行文本框分词算法的文本内容提取识别方法,根据行文本框的位置信息、语义信息、手指坐标信息,使用简单高效的算法实现提取出距离手指最近的词语,该算法简单高效,解决了服务器资源不足的问题。同时本发明使用目标检测、手部检测识别、文本检测、文本识别实现找到手指关键点的坐标,检测出图片中文本框位置信息,识别出图片中目标文本框中文字内容,使用现有模型加上后期训练后,准确度提高,速度变快,可以更好配合手指选词的算法。
📄 2022105885148
📂 G06V30_413
👤 浙江理工大学
📅 2022-05-26
本发明涉及一种面向文献的表格信息抽取方法,属于数据处理以及计算机视觉领域。该方法包括以下步骤:1:利用规则获取所有可能含表格的候选页面;2:将获取的页面转化为图片文件;3:采用深度学习方法,获取图片文件的特征;4:根据获取的图片文件的特征,对图片进行特征融合;获取融合后的特征;5:根据获取的特征融合后的特征,对表格的位置进行初步定位;6:针对获得的表格定位信息,根据表格元素的长宽关系,将横板表格旋转为竖版表格;7:根据获得的竖版表格,读取单元格字符流。本发明能自动对表格位置进行准确的定位,能够精确的从表格中读取表格的字符流。
📄 2021107368832
📂 G06V30_413
👤 南京信息工程大学
📅 2021-06-30
本公开实施例公开了用于处理信息的方法和装置。该方法的一具体实施方式包括:读取第一配置信息集合和第二配置信息集合;根据第二配置信息的开放标识,从第二配置信息集合中确定至少一条第二类别信息存储到预设的列表;响应于确定第一配置信息集合中第一类别信息与列表中的第二类别信息相同的至少一条第一配置信息的模型显存占用量之和小于预设的总显存,初始化列表中的第二类别信息对应的检测模型,得到初始化后的至少一个检测模型;基于至少一个检测模型和预先建立的识别模型,对接收的信息处理请求进行处理。该实施方式简化了识别功能上线的步骤,降低了识别功能上线的成本。
📄 2020100672165
📂 G06V30_413
👤 北京百度网讯科技有限公司
📅 2020-01-20
本发明涉及一种基于多模态交互融合网络的图文情感分析方法及系统,属于人工智能领域,包括对图文进行预处理,分离出文本和图像,并采用词嵌入技术处理文本,采用图像处理技术处理图像;使用空洞卷积神经网络、双向长短时记忆网络和注意力机制构建文本特征提取模块,使用深度卷积网络构建视觉特征提取模块;设计面向图文的多模态交互融合网络,并采用多个具有不同神经元的多模态交互融合网络建模不同粒度的图文相关性;融合不同粒度的图文特征,并通过多层感知机获取图文情感倾向;使用交叉熵作为损失函数,并使用带有热启动的Adam优化器训练模型。
📄 2021104123231
📂 G06V30_413
👤 重庆邮电大学
📅 2021-04-16