一种基于深度学习OCR的图书馆图书快速定位方法,包括以下步骤:(1)书脊识别准备:拍摄目标书籍所在书架区域的照片作为输入图像,并输入目标书籍的编号;(2)标签区域检测:使用FCN-32定位输入图像中的标签区域,将标签区域子图切割出馈送至(3);(3)标签文字识别:使用卷积模块+序列模块+解译模块三层模块级联的深度学习OCR方法识别标签区域子图中的文字,即识别出书籍编号,并被馈送至(4);(4)目标书籍定位步骤:将识别出的所有书籍编号与读者输入的目标书籍编号进行相似性匹配,相似性最高的书籍编号对应的文字区域在照片中被醒目标识出来。本发明在查阅图书时能更快更方便地找出目标书籍。
📄 2019103265863
📂 G06K9_34
👤 浙江工业大学
📅 2019-04-23
一种基于碑帖的毛笔字分割识别方法,包括以下步骤:步骤1:处理训练集图片;步骤2:训练样本预处理操作;步骤3:读取步骤2中处理好的图片进行模型的训练,特征矩阵MLH和特征向量矩阵Me是根据碑帖训练出来的模型;步骤4:整图文字分割,把一张图中的毛笔字从图中分割出来;步骤5:判断步骤4中分割出的文字属于碑帖中的哪一个文字,得到该图片的降维特征矩阵MP;计算相似度,计算MP与MLH每一行的距离Dist,求出最小值的那一行所表示的汉字就是需要识别的汉字。本发明提供一种有效实现毛笔字分割、识别准确率高、识别速度快的基于碑帖的毛笔字分割识别方法。
📄 2017101023038
📂 G06K9_34
👤 浙江工业大学
📅 2017-02-24
本发明提供了一种基于粗定位车牌的字符分割方法。该方法能自动判断出车牌是否完整,并能在车牌完整的基础上实现精准字符分割。首先挑选出二值车牌图像中能框出独立字符且不存在干扰的最佳独立连通区域外接矩形,将其宽度与其余连通区域的外接矩形宽度形成特征映射关系,建立训练库。利用训练库学习得到测试二值车牌的理论字符宽度,并以此调整每个连通区域的外接矩形尺寸,得到粗分割结果,接着直接对粗分割结果进行识别,挑选出识别置信度最高的字符。通过识别置信度最高字符的中心位置判断其在车牌中所处的位置,以此确定不同位置字符的中心点,以实际字符宽度向左右扩展,即可得到每个字符精准的分割结果。
📄 2017107807782
📂 G06K9_34
👤 南京邮电大学
📅 2017-09-01
本发明公开了一种基于改进YOLO v3的古文字及字体识别方法。该方法基于深度学习的目标检测方法,利用深层的神经网络结构,学习到古文字图像中“整体-部分”的分解关系,通过特征提取网络获得有用的特征信息,并进行检测定位,再将图片的特征信息送入分类器进行分类识别,并使用包围框在图像中框选出古文字的位置。该方法解决了古文字具有复杂的内部结构,以及使用这些特征进行识别时精度低的问题。本方法提出的改进YOLO v3使用ShuffleNet v2作为模型的主干结构,使其更加高效。在对古文字及字体的识别上准确率达到98.81%,并且具有较好的稳定性和良好的鲁棒性,能够应用于古文字文本、碑帖等古文字识别场景。
📄 2019112777822
📂 G06K9_34
👤 杭州电子科技大学
📅 2019-12-11
本发明涉及的是岩性特征库匹配的PDC钻头条件下岩屑岩性识别方法,它包括:一、在PDC钻头条件下进行钻井,采集细小岩屑颗粒白光原图和荧光图像;二、将白光原图和荧光图像分别从RGB颜色空间图像转化为HSV颜色空间图像;三、采用阈值分割公式对荧光图像进行分割;四、通过基于分水岭和近邻区域合并的图像分割算法对白光原图分割,分割出整个白光原图的所有岩屑颗粒;五、提取对应位置岩屑颗粒的颜色和纹理特征,构建岩性特征库;六、计算岩性特征库特征与待匹配岩屑特征的巴氏相似度距离,根据相似度距离得到的匹配结果计算特征岩屑所占面积比,完成岩屑岩性的识别。本发明提高了岩屑的特征表达能力,提高了岩屑的识别精度。
📄 2020105932563
📂 G06K9_34
👤 东北石油大学
📅 2020-06-26
本发明公开了一种图像检测方法,包括:基于第一比例以及待检测图像的几何中心,对所述待检测图像进行裁剪,以得到第一图像;基于预设尺寸调整所述第一图像的尺寸,以得到第二图像;基于目标深度神经网络模型对所述第二图像进行检测,以获得检测结果;在基于所述检测结果确定所述第二图像中存在物体时,基于所述检测结果输出待检测图像中物体的类别以及所述物体在所述待检测图像中的坐标。本发明还公开了一种图像检测装置及计算机可读存储介质。本发明通过由图像中心点开始由内到外逐渐增加裁剪范围的方式,实现了对图像中心物体的快速识别。
📄 2018116171499
📂 G06K9_34
👤 乐山师范学院
📅 2018-12-27
本发明提供了一种基于深度学习的急流线提取和识别方法,属于气象技术领域,将深度学习模型应用于急流区域的识别和提取,并采用大量的真实气象数据和气象专家的标注数据,以及有效可行的数据预处理方法,将识别急流线重要的两个特征风速和风向一致性,对应为图片的三个通道,利用深度学习在图像领域的创新算法,提高对于急流线识别的准确性,采用基于密度聚类的DBSCAN方法,对急流区域进行分类,并采用基于BP网络的回归模型,对急流区域进行线条的拟合,可以让模型学习到急流线的常规绘制方法,且在深度学习的基础上能提高急流线绘制的准确性,降低问题的复杂性。本发明解决了急流线提取和识别的传统方法中的区域限制和普适性差的问题。
📄 2021102762137
📂 G06K9_34
👤 成都信息工程大学
📅 2021-03-15
本公开的实施例公开了局部地图调整方法、装置、设备和计算机可读介质。该方法的一具体实施方式包括:获取局部地图;对局部地图进行语义分割,得到分割后的局部地图,其中,分割后的局部地图包括动态物体图像区域和静态物体图像区域;对分割后的局部地图包括的动态物体图像区域和静态物体图像区域进行特征点标注,得到标注后的局部地图;将标注后的局部地图包括的动态物体图像区域对应的特征点集合进行剔除,得到剔除后的局部地图;对剔除后的局部地图进行调整,得到调整后的局部地图。该实施方式实现了对局部地图的调整,提高了用户体验,为用户的生活提供了便利。
📄 2021100209163
📂 G06K9_34
👤 禾多科技(北京)有限公司
📅 2021-01-08
本发明提供了一种基于CGAN图像扩增的变电设备红外图像温度值识别方法,包括图像扩增和温度值识别两部分,采用全局阈值将设备红外图像进行二值化处理,并结合垂直投影法进行温度值的定位和分割,建立数字“0‑9”和符号“‑”共11种类型的温度值数据库,接着使用CGAN进行图像扩增,最后采用HOG+SVM进行训练和识别,完成温度值识别。本发明的有益效果为:通过统计红外图像的直方图特点确定全局阈值T,提高了二值化的准确性和可靠性,通过CGAN图像扩增克服变电设备红外图像温度值数据集样本小、不平衡的问题,同时能够自动识别图像上的温度值,与传统检测算法相比识别准确率更高,满足了温度值识别的要求,有效降低了电力检修人员的劳动强度,提高了工作效率。
📄 2021104127745
📂 G06K9_34
👤 南通大学
📅 2021-04-16
本发明实施例提供一种基于分割网络优化的图像语义分割方法及系统,其中方法包括:确定待语义分割的图像;将所述图像输入至分割网络优化模型中,得到所述分割网络优化模型输出的图像语义分割结果;其中,所述分割网络优化模型是基于样本图像以及对应的像素类别标注进行多阶段损失函数训练后得到的,所述像素类别标注是预先确定的。本发明解决了现有传统的语义分割模型的训练方法不能很好地勾勒出分割部分的边界,对超声图像进行分割时经常出现不圆滑的边界和锯齿状边界的现象问题。
📄 2021103943337
📂 G06K9_34
👤 北京工业大学
📅 2021-04-13
本发明公开了一种对在架紧密排布图书图像分割提取单本书脊的方法,其特征在于:包括如下步骤:步骤1,通过图书管理机器人中的主控模块获取书架上紧密排布图书图像;步骤2:对步骤1中的紧密排布图书图像利用索书号标签边缘处颜色特征,通过颜色空间和行投影方法提取索书号标签边缘,定位索书号区域,并利用阈值分割算法提取多本图书索书号区域;步骤3:在步骤2提取多本图书索书号区域后,对紧密排布图书图像取反;步骤4:分割单本书脊;本申请揭示了一种对在架紧密排布图书图像分割提取单本书脊的方法,实现分割单本书脊功能,可以更加快速,更加高效的分割出单本书脊,便于图书管理机器人对图书进行精确的抓取和放置。
📄 2020101460756
📂 G06K9_34
👤 南通大学
📅 2020-03-05
本申请提供一种文字识别的方法、装置及电子设备,所述方法包括:从目标文字图片中提取特征图;对所述特征图进行滑窗处理,得到时空特征序列;将所述时空特征序列输入到预先训练的时空注意力模型,以由所述时空注意力模型对所述时空特征序列编码处理得到时空语义编码,并对所述时空语义编码解码输出识别出的所述目标文字图片中的文字信息。本申请技术方案,可以基于目标文字图片的两个维度的信息识别目标文字图片包含的文字信息,有效提高了识别率。
📄 2018106912822
📂 G06K9_34
👤 广东高航知识产权运营有限公司
📅 2018-06-28