本发明一种财务报表的核对纠错方法及其装置,其特征在于通过带有颜色标识的投影将报表上需要核对的数据进行明显标识,以便人员核对,提升核对效率,且核对的同时通过自动摄影,能够将报表数据转换成电子数据进行整合保存,能够提升核对纠错财务报表效率,通过带有颜色的标识投影将报表上的需要核对位置进行明显标识,以便于人眼捕捉核查,降低核对出错率。能过在核对的同时将标识有重要区域的报表进行摄像,将报表数据转换成电子数据进行整合保存。能够通过吸附气孔保证纸质报表采集时的平整,避免报表褶皱产生的核对错误。
📄 2020105394151
📂 G06V30_418
👤 江苏建筑职业技术学院
📅 2020-06-14
本公开提供了文字识别方法、装置、电子设备以及存储介质,涉及人工智能技术领域,具体涉及计算机视觉和深度学习技术领域,可应用于OCR光学字符识别等场景。具体实现方案为:采用骨干网络对待识别的目标图像进行特征提取,得到特征图;将特征图输入第一网络,以预测特征图中的各特征点是否属于文本框,以及所属的文本框在目标图像中的位置;将特征图输入第二网络,以预测特征图中各特征点所属文本框之间的关联关系;根据各文本框的位置,对目标图像中对应图像内容进行文字识别,得到各文本框对应的文字内容;根据各文本框之间的关联关系,对各文本框对应的文字内容进行组织得到结构化信息。由此,提高了文字识别的准确性。
📄 2021109452593
📂 G06V30_412
👤 北京百度网讯科技有限公司
📅 2021-08-17
一种图片的商标图形要素编码生成方法,包括建立样本库,获取样本商标图片及其所对应记录的商标图形要素编码;对待处理商标图片进行预处理以获取有效区域图像;采用同一方向的分割线对有效区域图像进行多等份细分,获取有效区域图像的细分区域,提取该细分区域的图像特征数据获取图像特征描述符;以图像特征描述符为检索关键词进行样本商标图片查询,获取初步样本商标图片查询结果;对初步样本商标图片所对应记录的图像特征描述符与输入商标图片所提取的图像特征描述符进行匹配率计算,以获得匹配率排序参数;根据匹配率排序参数获得输入商标图片的商标图形要素编码。实现商标图形要素编码自动识别和标准化识别,提高商标图形要素编码划分效率。
📄 2021108738790
📂 G06V30_412
👤 徐庆, 面谷图像技术(佛山)研究中心, 佛山市国方识别科技有限公司
📅 2021-07-30
本发明公开了一种基于freeman码的文档图像倾斜校正方法,具体包括:步骤一,图像预处理,将图像转换为灰度图像,进行二值化、形态学操作;步骤二,图像有效文本连通块提取,去除图像中的非文本图像;步骤三,连通块图像细化处理,提取文本连通块骨架,对其进行去毛刺处理;步骤四,倾角计算,提取文本连通块骨架的轮廓,对其进行freeman码边界跟踪,计算每个连通块轮廓的链码值以及所占的比例,把竖向和横向方向对应的链码值个数所占比例最高对应的角度作为旋转角度;步骤五,文档图像倾斜校正。本发明支持含有插图、表格等的复杂文档图像。
📄 2023103182585
📂 G06V30_41
👤 浙江工业大学
📅 2023-03-29
本发明提出一种针对三线表的表格结构识别的方法、设备和存储介质,预处理图片,得到二值化图像,取反后进行水平腐蚀和水平膨胀,得到水平表格线图像;将二值化图像和水平表格线图像的像素逻辑或,得到无表格线图像,分别进行水平腐蚀和垂直腐蚀,并将结果合并,得到初始单元格掩膜;遍历水平表格线,再次分割单元格,得到最终单元格掩膜,计算并获取其中所有单元格的信息,得到代表三线表的表格结构;本发明提高对各种类型的三线表结构识别的准确率,有效减少单元格漏检、多检的问题,结果包含的信息完整、具体,有利于后续的表格结构还原等处理;采用非数据驱动的方法,无需大量数据,运算量小;可以更准确、通用地识别出三线表的表格结构。
📄 2022109154211
📂 G06V30_412
👤 浙江工业大学
📅 2022-07-31
本发明涉及一种电子助视器及其适用的智能手机文本辅助阅读方法,未识别到手势时抓拍一帧图像并保存,得到图像中文本的检测识别结果,为第一帧图像则将文本输出至语音播放模块播放,否则以该文本与上一帧的识别文本进行相似文本识别,基于是否相似选择去重播报或要求用户重选页面;基于是否收到关闭信息进行程序的关闭或反复。本发明使得低视力人群在手机使用场景下能通过电子助视器实现文本的流畅阅读,极大改善视障用户在使用智能手机时的文本阅读体验,一定程度解决手机应用在不支持无障碍模式下的文本阅读问题,亦可在用户自行选择下对文本进行识别播报,使视障用户可以从繁忙操作中解放出来,改善文本阅读体验,提高阅读效率。
📄 2020111988180
📂 G06V30_414
👤 浙江工业大学
📅 2020-10-31
本发明公开了一种基于Transformer的中文环境数学公式提取以及识别方法。该方法包括在中文环境下将含有数学公式的图片输入数学公式掩模提取模块,提取获得含有数学公式的掩模,在该掩模中仅保留了数学公式部分而剔除了其他位置的文字部分;再输入进入数学公式图片提取模块,该模块通过形态学方法对掩模中的数学公式位置进行进一步的修补以及完善,根据修复后的掩模生成数学公式图片;再输入进入转换展示模块,经过该模块处理得到该公式的Latex,并通过Katex再生成数学公式图片进行展示和对比。本发明方法基于Transformer技术提高了公式提取以及公式识别的准确率。不同于现有技术,本发明可以自动对输入图片的公式区域进行推断,使用起来更加方便。
📄 2022107723627
📂 G06V30_414
👤 浙江工业大学
📅 2022-06-30
本发明公开了一种融合局部特征的表格识别方法。首先进行区域分块提取及横向线段检测、聚类行距均值求解、基于行距阈值的分块区域纵向线段检测;其次,采用自适应阈值的图像腐蚀灰度二值化,使用自适应阈值的横向线段提取及基于行距阈值的纵向线段提取,同时采用基于纵向线段的分块区域融合掩膜处理;最后,对融合掩膜输出图进行基于轮廓提取得到预提取区域,并使用区域重检测算法进行预提取区域的精准检测。经试验验证,该方法可以有效的解决未矫正复杂表格的准确定位提取,在倾斜未矫正复杂测试集样本中,平均准确率可达98.25%以上,该方法简洁有效,具有一定的实际可行性。
📄 2020110626341
📂 G06V30_412
👤 西安工业大学
📅 2020-09-30
本申请实施例提供了一种包含文本的图像合成方法、装置、计算机设备和存储介质,基于模板图像的文本标注信息,预测模板图像的文本填充参数,文本标注信息用于指示模板图像包括的至少一个字段的原始文本和第一属性信息,文本填充参数用于指示模板图像中各字段的内容填充格式;生成模板图像中各字段分别对应的合成文本;根据第一属性信息和文本填充参数,在模板图像中依次采用各字段的合成文本替换对应的原始文本,得到多张合成图像。在该方法中,只需对模板图像进行简单标注,即可预测模板图像的文本填充参数,减少了人工标注量。其次,通过合成文本替换原始文本生成与模板图像属于同类型的多张合成图像,提高了包含文本的图像合成效率。
📄 2022114104640
📂 G06V30_41
👤 杭州海康威视系统技术有限公司
📅 2022-11-11
本发明公开了一种用于不规则表格图像拉平的表格结构检测方法,包括:1.对原始图像进行表格区域检测,得到表格区域图片;2.对表格区域图片进行表格规范性检查;3.对不符合规范的表格区域图片进行预处理;4.对表格区域图片进行边框识别。本发明采用了一种新的方法一种能将不规则的表格进行预处理拉平的技术,使得表格变得规则,该方法可以有效的解决表格不规则的问题,从而提升算法的可操作性,也能提取不规则表格的语义信息,并且该算法相比较于深度学习的算法而言有省去了训练模型的时间,大大提高了识别表格的时间效率。
📄 2022107279284
📂 G06V30_412
👤 浙江理工大学
📅 2022-06-23
本发明公开了一种基于定量偏移的表格识别方法、装置及设备。包括:对需要识别的目标表格建立坐标,其中,坐标包括行候选坐标和列候选坐标;获取目标表格的行真实交叉点;获取目标表格的列真实交叉点;对目标表格的行真实交叉点进行过滤,识别合并行;对目标表格的列真实交叉点进行过滤,识别合并列。基于定量偏移识别,通过判断真实交叉点数量与横、纵候选坐标的个数之积是否相同进行识别,识别效率更高;体量更小,执行速度更快;通过识别合并行和合并列的操作实现表格数字化管理。
📄 2022106704169
📂 G06V30_412
👤 浙江理工大学
📅 2022-06-14
本发明公开了一种基于行文本框纵向合并的文本内容提取识别方法,利用手指在设备摄像头下指出想要查看的题目,以图片的形式上传到服务器,通过简单算法就可以将和本题相关的所有的文字用一个矩形框框选出来,实现一个行的纵向合并,并且将矩形框中文字呈现出来。本发明根据文本框的位置信息、语义信息以及手指坐标信息,使用简单高效的算法实现多行相关文本框的合并,并将合并后文本框中的内容输出,该算法简单高效,解决了服务器资源不足的问题。同时本发明使用目标检测和手部检测识别实现找到手指关键点的坐标,使用现有模型加上后期训练后,精度提高,速度变快,可以更好配合文本框合并的算法。
📄 2022104997964
📂 G06V30_414
👤 浙江理工大学
📅 2022-04-28