本发明涉及一种基于CIP数据质量控制的云微粒子分类方法,主要包括首先对CIP图像进行预处理,然后对二值化的CIP图像进行云微粒子图像质量控制,接着CIP图像进行分割处理,建立基于迁移学习的深度神经网络分类模型,由于现有方法中缺乏对CIP数据进行图像质量控制并结合深度神经网络对CIP云微粒子图像进行分类,通过该方法可有效的提高对CIP云微粒子图像分类准确率。
📄 2020104957582
📂 G06K9_62
👤 成都信息工程大学
📅 2020-06-03
面向行业领域的同源样本数据分类存储的预处理方法、系统,属于数据处理领域。本发明方法包括步骤S1,创建包含各行业领域平台字段的关键字集;步骤S2,获得用户网络内所有成员的网络行为日志数据,对所述网络行为日志数据进行行业领域匹配并进行行业领域划分;步骤S3,根据经过行业领域划分的所述网络行为日志数据对所述成员在各个领域内的网络行为活动进行分析,推测用户的基本属性和网络行为特性进分类储存,实现面向行业领域的同源样本数据分类存储的预处理。本发明实现同源样本数据在多个行业领域的用户行为日志集,多维度进行分类预处理存储,为用户网络行为画像和各用户之间的关联提供多维度的数据依据,具有重要作用和商业价值。
📄 2017106603576
📂 H04L12_24
👤 深圳市其乐游戏科技有限公司
📅 2017-08-04
本发明实施例提供一种数据集获取方法、一种利用数据集分类的方法、装置、计算机设备及存储介质。其中,所述一种数据集获取方法包括:获取消息级别的对话文本数据并进行预处理;根据预先设定的质检点和质检点对应的规则,利用全文搜索引擎,从预处理后的对话文本数据中查询出与所述规则匹配的质检点并进行标记以得到质检结果;将标记后的包括质检点的对话文本数据整合成包括质检点的会话级别的会话文本数据;根据用户对所述会话文本数据中质检点的修改请求来更新质检结果;按照预设格式从更新后的数据中提取出数据集。本发明实施例可提取出准确的数据集,利用提取出准确的数据集进行分类,可提高分类模型分类的准确率。
📄 2018102412273
📂 G06F17_27
👤 平安科技(深圳)有限公司
📅 2018-03-22
本发明公开了一种微博评论数据分类方法及系统。所述方法包括:对待分类的微博评论数据进行分词处理,得到待分类分词文本;采用训练好的Word2Vec模型对待分类分词文本进行处理,得到待分类词向量;采用TF‑IDF算法对待分类词向量进行权重计算,得到待分类多维词向量;将待分类多维词向量输入至训练好的Multi‑LSTM模型中,得到待分类的微博评论数据的分类结果;训练好的Multi‑LSTM模型是由训练好的第一Bi‑LSTM层、训练好的第二Bi‑LSTM层、训练好的LSTM层和训练好的全连接层依次连接而成。本发明能准确、快速地对微博文本进行分类,实现对微博评论的拦截,进而更好地维护互联网环境。
📄 2020111027588
📂 G06F40_289
👤 燕山大学
📅 2020-10-15
本发明公开了一种大规模跨平台基因表达数据分类方法,包括以下步骤:S1、获取训练集,初始化分类器;S2、对训练集进行数据转换;S3、根据训练集计算相对偏移表;S4、生成候选偏序对,并计算出候选偏序对中的top偏序规则r;S5、更新分类器和训练集;S6、判断样本量与最小支持度θ的大小;S7、设定分类器CL缺省类;S8、预测分类。本发明针对跨平台基因数据挖掘这个问题,通过数据转换,提出了新的偏序对规则挖掘算法和分类模式,可以处理跨平台基因数据的差异性,不仅可以应对更复杂的数据分布,并且通过相对偏移表进行规则预筛选,显著提升了挖掘效率,能够应用于大规模数据上。
📄 2018100438368
📂 G06F19_24
👤 广东工业大学
📅 2018-01-17