本发明公开了一种OCR图像字符识别和字符校正的方法,在字符识别模块中:采用多级神经网络构造并拟合了汉字变形度Pr函数,该网络以图像CNN数据以及横竖撇捺四个额外特征作为为变量,以不同程度的GAN识别度作为“变形度”的训练值,反映目标汉字的变形度Pr;在字符校正模块中:增设第二级相似字区分网络用于对训练网络第一次确定的最佳识别结果进行高精度的相似字区分,二级网络的设置可以降低第一级网络的复杂度提高网络整体的泛化能力。本方法和系统主要针对机打发票、各种表格、单证进行识别,识别精度高,识别速度快,适应性强,对于部分信息缺失以及识别错误有很强的纠正能力;能够相对传统OCR识别技术的识别效果,大大提升识别准确度。
📄 2020103388122
📂 G06V30_14
👤 梁华智能科技(上海)有限公司
📅 2020-04-26
本发明公开的一种基于Caffe框架的深度学习车牌字符识别方法包括分类器训练和字符识别两个过程,分类器训练包括字符处理、分成汉字集和非汉字集以及建立Caffe架构学习网络结构、然后分别进行训练得到相对应的分类器,字符识别包括预先建立索引表并对抓取到的车牌图像进行处理,然后利用相对应的分类器识别后再通过查索引表得到识别结果,按顺序组合后即为车牌的最终识别结果。本发明的一种基于Caffe框架的深度学习车牌字符识别方法以基于Caffe架构的深度学习为基础,解决了现有的车牌字符识别方法中对倾斜、断裂、相近字符识别精度不高的问题,大大提高了对于车牌字符的识别精度。
📄 2016102981951
📂 G06K9_32
👤 西安理工大学
📅 2016-05-06
本发明公开了一种基于密度峰值聚类特征选择的三维手写字符识别方法。现有的三维手写字符识别方法没有充分考虑冗余特征对字符识别率的影响。本发明如下:一、采集运动指尖的三维坐标并生成离散点集。二、顺序连接离散点生成三维轨迹。三、预处理。四、提取书写方向,曲率,坐标差值三大类特征。五、利用对称不确定性的倒数1/SU衡量特征间的相似性。六、利用密度峰值聚类算法的定义计算局部密度ρ。七、根据密度峰值聚类算法计算与高密度特征的距离。八、计算局部密度。九、将γ按降序排列,选取聚类中心。十、基于十折交叉验证方法和决策树算法模型,得到最终的识别率。本发明可以在特征减少,计算量降低的情况下,识别率还能提高。
📄 2020104672709
📂 G06V30_32
👤 杭州电子科技大学
📅 2020-05-28
本发明涉及基于深度学习的钢坯喷标字符识别系统,包含图像采集装置,用于采集原始图像数据;推理服务器,用于接收原始图像数据,并将原始图像数据转发给内建于推理服务器中的识别模块;推理服务器与图像采集装置电信号连接;识别模块,用于对原始图像数据进行喷标字符识别操作,得到板坯号。本发明无需降低钢坯行进速度来进行拍照,提高生产线的效率;适应所在的采集识别地点的环境,大量增加适用设置位置;对锈蚀、磨损字符的识别,大幅提升识别率。
📄 2022103673900
📂 G06V10_22
👤 湖北工程学院
📅 2022-04-08
本发明公开了一种基于改进YOLOV5模型的纸质药盒钢印字符的识别方法,方法包括:使用图像采集设备采集药盒的钢印字符图像;对图像进行图像增强等预处理并且对识别区域打上标签;输入至改进的YOLOV5模型中进行训练,得到训练完成的YOLOV5模型;改进的YOLOV5模型包括:在YOLOV5的骨干网络中添加高效位置注意力机制CA(Coordinateattention)使得模型网络能够关注大范围的位置信息又不会带来过多的计算量,有助于模型性能提升以及更好地定位和识别目标;用SimSPPF替换SPPF快速池化层,提升训练速度;针对密集的小目标,在模型内额外使用了一个更小的先验框并且相应的增加了一个更小的检测头;将待识别的数据集输入处理,得到最终的预测结果。
📄 202310351717X
📂 G06V10_82
👤 浙江理工大学
📅 2023-03-30
本发明实施例提供了一种字符识别方法、装置及电子设备。其中,所述方法包括:对待识别图像进行字符识别,得到所述待识别图像中各字符的多个候选值;将预测字符串与预设的字符模板进行匹配,确定所述预测字符串与所述字符模板不匹配的位置,作为待编辑位置,所述预测字符串为所述待识别图像中各字符的置信度最高的候选值组成的字符串,所述字符模板用于表示所述待识别图像中包含的每个字符的取值范围;从所述待编辑位置对应的字符的候选值中,选择与所述字符模板中所述待编辑位置匹配的字符,作为参考字符;利用所述参考字符,对所述预测字符串的所述待编辑位置进行编辑,得到所述待识别图像的字符识别结果。可以提高字符识别结果的准确率。
📄 2019103685287
📂 G06K9_62
👤 杭州海康威视数字技术股份有限公司
📅 2019-05-05
本发明关于一种基于量子纠缠的字符识别方法,属于计算机技术和量子物理交叉领域。本发明提供的基于量子纠缠的字符识别方法,通过引入量子纠缠理论用于手写字符图像的识别,在丰富字符识别方式的同时,为量子物理和人工智能之间建立沟通搭建桥梁;此外,基于量子纠缠的字符识别方法在进行手写字符的识别作业能够具备较高识别率,可极大提高手写字符的识别准确率,缩短手写字符的识别时间,解决了现有字符识别方法存在的手写字符识别准确率低且识别时间较长的技术问题。
📄 201910954060X
📂 G06V30_148
👤 嘉兴大学
📅 2019-10-09
本申请提供一种字符识别方法及装置,方法包括:将待识别图像输入到字符识别模型,由本字符识别模型通过字符定位网络在待识别图像中定位字符关键点,输出到本字符识别模型中的字符矫正网络,由字符矫正网络在待识别图像中利用字符关键点和预设位置点的对应关系确定待识别图像中的字符区域对应的矫正图像,并输出矫正图像给本字符识别模型中的字符识别网络识别矫正图像中的字符。由于字符矫正网络可对存在倾斜、旋转、形变等问题的图像矫正,因此识别结果稳定性好且识别准确率高,且本字符识别模型通过字符定位网络定位字符关键点并通过字符矫正网络和字符识别网络可得到结果,无需从图像中检测精确字符框,也无需进行分割,因此识别准确率高。
📄 2018111846182
📂 G06K9_20
👤 杭州海康威视数字技术股份有限公司
📅 2018-10-11
一种基于相似字符识别的文本识别方法及电子设备,该方法包括:将待识别的文本通过科目识别模型,以识别出其对应的若干个潜在科目;根据潜在科目对该文本进行分词,获得若干个分词词语;根据分词词语与该潜在科目对应的分词库中每个分词的字符相似度,计算每个分词的置信度,并由此获取该潜在科目的总置信度,其中总置信度最高的潜在科目作为目标科目;针对目标科目对应的分词词语,获取该目标科目对应的分词库中置信度最高的分词,并在判断出其置信度高于某一预设阈值时,将分词词语纠正为该置信度最高的分词,以获得文本识别结果。实施本发明实施例,能够识别易被混淆误判的相似字符并根据科目信息进行纠正,从而提高文本识别的准确率。
📄 2019107493036
📂 G06V30_148
👤 广东小天才科技有限公司
📅 2019-08-14
本发明提供一种手写字符识别方法及装置,涉及文字识别技术领域。该方法包括:判断目标图形是否为单个数字;若是,则根据图形与单个数字的映射关系,获取目标图形对应的单个数字;若否,则判断目标图形的字符类型;其中,字符类型包括:数字类型、文字类型和符号类型;当字符类型为数字类型时,根据图形与数字的映射关系,获取目标图形对应的数字;当字符类型为文字类型时,根据图形与文字的映射关系,获取目标图形对应的文字;当字符类型为符号类型时,根据图形与符号的映射关系,获取目标图形对应的符号。对不同字符类型的手写字符的分开识别,提高了手写字符的识别率。
📄 2019101872151
📂 G06K9_68
👤 成都工业学院
📅 2019-03-12
本发明公开了一种针对光字符识别的码率设置方法、设备及存储介质,本方法首先对图片进行下采样,其次对下采样图片进行多次编码求取使得下采样图片能够被正确识别的最优QP/Rate值(最低的码率值/量化系数值),然后根据置信度神经网络求取码率增加量M/量化系数增加量N,最后快速找到针对该原始图片的最优编码值,该最优编码值是使得原始图片的光字符识别精度不受影响的最低码率值/最低量化系数值。相较于现有技术,本发明不仅可以减少网络传输带宽,而且针对大量数以亿计的图片也可以减少存储空间的占用而减少成本。而且本发明涵盖了主流的混合编码架构的应用场景,可以采用任意一种图像编码标准或者视频编码标准的帧内编码方式,应用广泛。
📄 2020101162193
📂 H04N19_124
👤 中南大学
📅 2020-02-25
本发明涉及图像识别领域,公开了一种基于BP神经网络预测阈值的仪表重影字符识别方法,包括如下步骤:获取数显仪表的彩色图像,并进行灰度化处理取得灰度图像,计算灰度图像的灰度级分布统计量,输入到BP神经网络,预测出理想的二值化全局阈值,并对灰度图像进行二值化,得到消除重影的二值图,再将二值图进行去除小连通域处理,创建二值图的最小外接矩形,计算出倾斜角度,并通过仿射变换实现倾斜矫正,采用投影分割法将矫正后的二值图分割成单个字符图像,将字符图像尺寸归一化到32×32,输入到LeNet‑5模型进行识别,取得数显仪表字符的识别结果。本发明基于BP神经网络预测阈值的仪表重影字符识别方法,有效克服重影的影响,识别率高、识别速度快。
📄 2019110383116
📂 G06V30_148
👤 湖北工业大学
📅 2019-10-29