本实用新型涉及发票筛选设备技术领域,公开了一种便于自动识别内容的发票筛选设备,包括底座、第一支撑板和显示屏,所述底座上方的左侧安装有第一支撑板,所述第一支撑板的左侧安装有显示屏,所述第一支撑板右侧的上方安装有第一连接板,所述第一连接板下方的右侧安装有摄像识别器,所述底座上方的右侧安装有滑动装置,所述滑动装置包括转轴、第二支撑板和储存槽,所述底座上方的右侧通过转轴与第二支撑板相连接,所述第二支撑板的左侧安装有储存槽,所述储存槽的外侧安装有第二连接板;本实用新型发票更加平整,以便装置快速识别发票内容,提高装置的工作质量。
📄 2024214263001
📂 G06V30_14
👤 南京诺奇科技有限公司
📅 2024-06-21
本发明涉及场景文本分割领域,具体是一种基于改进SAM视觉分割大模型的场景文本分割方法,本发明以SAM视觉大模型为基础,通过图像内容感知模块提取文本内容感知特征,文本边缘感知模块提取文本边缘感知特征,并通过文本特征融合模块提取计算文本边缘感知特征图在SAM编码器的每次自注意力计算前与需要注意力计算的向量进行相加来提高SAM在文本分割方面的准确率,并能够在保证泛化性的前提下缩短模型的训练时间。
📄 2025102157674
📂 G06V30_148
👤 浙江工业大学
📅 2025-02-26
本发明公开了一种倾斜汉字点选验证码识别方法,通过目标检测模型YOLOX预测文字位置框,文字位置框作为前景分割的输入参数,分割出汉字前景,把分割出的前景图二值化,并绘制最小外接矩形框,计算外接矩形框的斜率及角度,给出优选的3个矫正角度,旋转原图得到3张不同角度的矫正图,矫正图输入到文字识别模型中,比较在候选汉字范围内的识别概率,最大概率对应的矫正图即为最终矫正结果,在最终生成的概率矩阵中循环查找最大值并删除所在行列的方式得到文字位置框和候选汉字的最佳匹配结果。本发明矫正了验证码中的倾斜汉字,提高了汉字点选验证码的识别准确率。
📄 2022110460627
📂 G06V30_146
👤 浙江工业大学
📅 2022-08-30
本发明提供一种基于深度学习的字体识别方法、系统及存储介质,所述识别方法包括:获得含有目标字体的分割图像;对所述分割图像进行含有注意力机制的超分辨率重构,得到超分辨率字体图像,该方法可自文档、特别是自然场景或其他具有噪声干扰情形下的文档中获得高清晰的字体图像,并得到准确的分类识别结果。
📄 2021108429316
📂 G06V30_14
👤 西南大学
📅 2021-07-26
本发明公开了一种OCR图像字符识别和字符校正的方法,在字符识别模块中:采用多级神经网络构造并拟合了汉字变形度Pr函数,该网络以图像CNN数据以及横竖撇捺四个额外特征作为为变量,以不同程度的GAN识别度作为“变形度”的训练值,反映目标汉字的变形度Pr;在字符校正模块中:增设第二级相似字区分网络用于对训练网络第一次确定的最佳识别结果进行高精度的相似字区分,二级网络的设置可以降低第一级网络的复杂度提高网络整体的泛化能力。本方法和系统主要针对机打发票、各种表格、单证进行识别,识别精度高,识别速度快,适应性强,对于部分信息缺失以及识别错误有很强的纠正能力;能够相对传统OCR识别技术的识别效果,大大提升识别准确度。
📄 2020103388122
📂 G06V30_14
👤 梁华智能科技(上海)有限公司
📅 2020-04-26
本发明提出了一种基于运算符和中心线的数学公式识别的方法,其主要思路为:对公式图片进行切割;应用卷积神经网络(CNN)网络结构对字符图片进行识别;充分利用公式中不同种类运算符作用域固定的特点将其分为三类,分别是分号、特殊运算符和二元运算符号,其中特殊运算符包括根号、求和符号、积分符号等大符号,这些运算符有多个作用域,先将这些作用域内的子式判别出来并进行识别,将识别结果直接送入运算符的Latex语言表达式;然后基于字符在书写时受四线格约束的情况,提出中心线的概念,将常见字符分类为向上类、向下类、全占类和中心类,依据字符的中心线类别不同计算阈值,判断两个字符之间的上下标的位置关系。最终实现公式识别。
📄 2020116388900
📂 G06V30_148
👤 中传华夏(青岛)产业控股有限公司
📅 2020-12-31
本发明公开了基于深度学习的试卷批改方法,包括:获取写有标准答案的试卷图像P1,采集需要批改的试卷图像P2,并进行预处理;对预处理后的P1和P2分别进行霍夫直线检测,得到答题水平直线位置,进而得到单个题目的答题区域;利用YOLO v3网络提取答题区域中每个验证框的坐标信息及验证框内的数据,进而计算相邻两个验证框之间的距离;对两幅试卷图像中同一个题目序号对应的答题区域中每个数据信息进行比对,统计需要批改的试卷图像中正确题目与错误题目数量;根据需要批改的试卷坐标信息,提取需要批改的试卷对应的学号,将学号与相应试卷上所有题目正确与否存入数据库中。本发明可运用于试卷或者答题卡的选择题、填空题,不受题型以及答题卡格式的限制。
📄 2022101605824
📂 G06V30_148
👤 无锡学院
📅 2022-02-22
本申请公开了一种仪表刻度识别方法及装置,通过图像阈值化分割法提取出仪表图像的特征图像;所述特征图像包括具有特征性颜色的指针和仪表的警示区域;对所述特征图像进行像素筛选,得到筛选图像;为所述筛选图像绘制指针连通域的矩形框;检测所述指针的刻度区域的范围及坐标,根据量程读出读数;验证分析所述读数,判断所述指针是否达到所述警示区域。本申请能够自动识别读数实现数据的实时监控,无须人工干预,并且能够将刻度识别的指针读数自动与仪表的警示区域对比,能够及时报警。
📄 202011196971X
📂 G06V30_146
👤 江苏理工学院
📅 2020-10-30
本发明公开了一种基于SFE‑DBnet的医疗化验单影像文本检测方法,过程为:获取医疗化验单的图像并在计算机中输入SFE‑DBnet网络后,获得预测候选框来对化验单中的文本进行标记;SFE‑DBnet网络基于DBnet网络构建,包括通过结合了注意力机制模块CBAM和聚合残差块的ResNext50的主干网络来提取特征,再通过FPEM_FFM模块进行多尺度特征提取和融合,再经过BLSTM网络进行水平方向空间序列特征提取获得特征图。本发明的SFE‑DBnet网络能够有效地对医疗化验单中序号、项目名称、英文名、测定值、标志、单位、参考区间和检验方法等文本进行检测识别,检测能力得到了提升。
📄 2023101602182
📂 G06V30_14
👤 浙江理工大学
📅 2023-02-24
本发明公开了一种数字仪表示数端到端识别方法,包括获取原始数字仪表示数图像;从原始数字仪表示数图像中提取多张特征图,组成初始特征金字塔;对初始特征金字塔进行多尺度和多层次的特征融合,得到带有示数位置信息的特征图;对带有示数位置信息的特征图进行图像分割,生成概率图和阈值图;基于概率图和阈值图通过自适应可微二值化方法预测示数位置,得到近似二值图;以近似二值图作为二值掩膜,从带有示数位置信息的特征图中提取示数区域的特征图块;对示数区域的特征图块进行示数识别,得到数字仪表示数内容。本发明可以有效减少每个步骤的时间开销,在保持具有竞争力的准确性的同时还能够达到较高的推理速度。
📄 2023104113402
📂 G06V30_148
👤 成都天合一成科技服务有限公司
📅 2023-04-13
本发明公开一种基于OCR的证件识别方法、装置、计算机设备及存储介质,该基于OCR的证件识别方法包括:获取原始证件图像和证件类型;对原始证件图像进行预处理,获取待识别证件图像;采用文字定位模型对待识别证件图像进行文字定位,获取待识别文字位置;基于待识别文字位置,对待识别证件图像进行裁剪,获取待识别文字区域;采用与证件类型相对应的预设区域模板对待识别文字区域进行分类,获取待识别文字区域对应的文字类别;基于待识别文字区域对应的文字类别,将待识别文字区域输入到与文字类别相对应的目标识别模型中进行识别,获取待识别文字区域对应的证件文本信息,该基于OCR的证件识别方法可有效提高证件图像识别的准确率和效率。
📄 2018111821448
📂 G06V30_148
👤 平安科技(深圳)有限公司
📅 2018-10-11
本申请实施例属于人工智能领域,应用于智慧医疗领域中,涉及一种基于文字检测模型的文字识别方法及其相关设备,包括接收待识别的文字图片,在待识别的文字图片的方向不是标准方向时,基于训练后的方向检测模型对待识别的文字图片进行旋转矫正,获得矫正后的文字图片;将矫正后的文字图片输入至训练后的文字检测模型中,获得输出的包含至少一个初始检测框的初始图像;分别基于每个初始检测框,对所述初始图像进行旋转和裁切操作,获得至少一个目标图像;基于所有目标图像生成图像列表,将图像列表输入至训练后的文字识别模型中,获得输出的文字识别结果。文字识别结果可存储于区块链中。本申请避免文字图片失真,提升计算机识别文字的准确度。
📄 2021109742736
📂 G06V30_146
👤 平安科技(深圳)有限公司
📅 2021-08-24