一种基于CUDA的网络入侵检测并行化加速方法。方法采用了CUDA并行计算模型,首先针对网络入侵检测系统中的k‑means算法进行了并行化分析,设计了一个全局选择器,在距离计算前运用全局选择判断入侵检测数据点所属聚簇是否改变,减少了冗余计算;然后在距离计算时采用了CUDA提供的通用矩阵乘函数进行加速,提高了运算速度;最后在聚簇中心更新时将所有入侵检测数据点按照簇标签排序分组,通过组内数据简单相加,减少了原子内存操作,从而提高整体性能。实验结果表明,本发明提出的加速方法是有效的,在保证检测率的情况下,有很高的并行化加速性能。
📄 2018103665556
📂 G06F21_55
👤 浙江工业大学
📅 2018-04-23
一种基于随机与并行计算策略的RTL级电路可靠性度量方法,首先,对网表进行解析并对相关量进行初始化,以为后续计算做好准备;接着,基于sobol序列构建均匀非伯努利序列的生成方法,并基于该序列生成方法分别利用并行计算策略构建长度为ls的电路输入向量与面向模块输出端的故障注入许可序列;然后,基于随机计算策略分别并行计算了针对各输入向量在不同状况下的电路逻辑输出;最后,通过最大‑最小蚁群算法实现了算法的自适应收敛。本发明有效兼顾评估精度与计算速度。
📄 2020102163704
📂 G06F30_327
👤 浙江工业大学
📅 2020-03-25
本发明公开了一种基于并行计算的像素筛查方法,包括以下步骤:步骤一:首先根据图片像素的数量分配相应的threads;步骤二:通过每个线程协作运行对分块图像进行运算;步骤三:对每个像素和预设设定的缺陷阈值进行比较;步骤四:利用规约算法对共享内存中的数据进行计算得出最终结果;本发明能够有效减少像素筛查的计算时间,完成待处理图像的缺陷统计所需的时间将远小于传统串行筛查算法,从而保证缺陷检测的实时性。
📄 2019100999649
📂 G06T7_00
👤 浙江工业大学
📅 2019-01-31
一种用于光滑粒子流体动力学模拟出血及处理加速的方法,利用基于GPU加速的模拟方法来模拟虚拟手术中的出血及利用虹吸原理吸出渗血的效果;同时,利用网格法实时划分问题区域,创建以支持域为边长的空间网格,通过临近网格搜索最近相邻粒子,并且通过并行计算架构(CUDA)多线程并行加速技术完成粒子控制方程的求解以及血液与固体交互的计算,大大提高了运算效率,从而提高了手术训练的实时性。此外;改进的移动立方体算法(marching cube)被用于流体表面的渲染,大大提高了手术训练的真实性。
📄 2017108209574
📂 G06F30_20
👤 浙江工业大学
📅 2017-09-13
一种低显存下的矩阵及其转置快速乘法方法,包括:1)根据获得的矩阵数据,将其按照规定格式存储在文本文件中,采用快速读入模块将矩阵数据读入到内存中;2)将步骤1)中的原始矩阵传入到显存,并对答案矩阵进行化简、向量化、分组,传入到显存;3)组内进行并行计算,组间进行串行计算;4)步骤3)所得到的多个数组进行合并,并与答案矩阵进行转换,输出最终解。本发明能在硬件的显存大小较低的情况下,利用GPU的并行计算框架,充分发挥显卡的性能,快速地完成大规模矩阵及其转置乘法。
📄 2022110793235
📂 G06F7_523
👤 浙江工业大学
📅 2022-09-05
本发明提供了一种基于CPU‑GPU异构复合式并行计算框架的密码子偏差系数实现方法,包括:在刀片机上建立集群,每台刀片机作为一个节点;并将主节点同时设置为主节点和从节点;搭建CUDA框架环境,并进行网络配置;对提交的批量作业目录进行预处理,拟合输出包含各个待处理任务文件实际HDFS存储位置的任务清单到指定的目录;定义对任务清单的划分规则,并发送到节点中进行处理;获取到单个任务文件的HDFS路径,将其下载到本地节点后,整理为命令请求;并将文件内容和命令请求发送到GPU服务器上;在监控到GPU服务器端计算完成后,将输出文件下载到本地,并上传至HDFS。本发明在批量作业提交情况下实现作业划分、并行处理以及内存计算,提高了密码子偏性算法的效率。
📄 2017103325757
📂 G06F9_50
👤 西南大学
📅 2017-05-12
基于忆阻器交叉阵列的全尺寸卷积计算器,其特征在于,包括卷积核矩阵;输入阵列:输出电路输出卷积结果。一种全尺寸卷积计算器的卷积方法,卷积核矩阵获取输入数据,卷积核矩阵将低于忆阻器阈值电压的脉冲电压信号送卷积核正值输入端,经运算电路后得m个数据;每个数据接入输入阵列,在F个卷积计算单元内与存储在忆阻器交叉阵列中的输入数据实现累加求和;输出结果。显著效果,利用忆阻器阵列的高集成度和尺寸优势,通过增加存储区域来加速卷积计算;该卷积器能并行计算卷积矩阵上平铺的所有卷积区域的卷积计算,计算效率显著增加,且输入数据越大,效果越显著。
📄 2022115500601
📂 G06G7_19
👤 重庆博金斯科技有限公司
📅 2022-12-05
本发明公开了一种城市供水管网优化方法。本发明首先采用年值法建立供水干管优化模型。然后利用拉格朗日函数建立供水干管优化连续型Hopfield神经网络模型的能量函数和优化变量的运动方程。最后运用Hopfield神经网络和模拟退火混合计算的方法对步骤A建立的模型进行求解。本发明Hopfield神经网络是并行计算的,其计算量不随维数的增加而发生指数性质的爆炸,对于供水管网优化问题的高速计算特别有效。
📄 2013102071261
📂 G06Q10_04
👤 杭州电子科技大学
📅 2013-05-29
本发明公开了一种减少图像标签融合冗余计算的方法。本发明的方法是利用GPU多线程并行计算,整体上提取目标图像和多图谱图像的灰度特征,再建立一个从目标图像的灰度特征到多图谱图像的灰度特征的映射地图,通过映射地图寻找每个点匹配到的多图谱点集和对应的标签集,接着用欧氏距离计算匹配到的点集处的权重值,然后统计可能匹配的每个标签值的权重,找到目标图像每个点处对应权重值总和最大的标签值,最后得到带标签的分割图像。本发明所述的方法能够保证在不改变原有算法的分割精度的条件下,根据GPU多线程并行计算的特点,通过改为适用于GPU多线程的计算方式,来减少标签融合时的冗余计算,提高医学图像的分割效率。
📄 2017109620592
📂 G06T7_10
👤 杭州电子科技大学
📅 2017-10-16
本公开提供了一种基于卷积神经网络的数据分类方法、系统、介质及设备,对获取的分类数据进行预处理,构建数据集;构建卷积神经网络,所述卷积神经网络中至少包括一个卷积层,用于提取局部特征,所述卷积层对特征矩阵进行压缩,并对所生成的稀疏矩阵在图形处理单元上进行稀疏矩阵向量乘运算,利用数据集中的数据训练卷积神经网络;将待分类数据预处理后输入到已训练好的卷积神经网络模型,输出数据分类结果;本公开通过对卷积层的特征矩阵进行压缩处理,在GPU上并行计算,减少了在计算过程中内存消耗和对于零值的计算,进而减少了神经网络的训练时间和内存消耗。
📄 2019111735875
📂 G06K9_62
👤 山东师范大学
📅 2019-11-26
本发明公开了基于改进的蒙哥马利模幂电路的IC卡解密方法,本发明选择了RL二进制扫描作为模幂的实现方式,使用了改进的高性能蒙哥马利模乘器来实现解密系统。先进行全硬件实现的参数预计算,再通过高性能的蒙哥马利模幂电路计算RSA解密结果,整个系统结合多种侧信道攻击防御方法,采用了随机进行伪操作来抵抗SPA,随机盲化密钥来抵抗DPA。并行计算模乘和模平方抵抗时间攻击,模幂末尾连续计算两次抵抗FIA。本发明既提高了IC卡密文解密应用场景的灵活性,又克服了常规蒙哥马利模幂模块计算周期较长的问题,大大提高了电路性能和系统安全性。
📄 2020113284914
📂 H04L9_08
👤 杭州电子科技大学
📅 2020-11-24
本发明公开了一种陆基长波导航/授时系统ASF预测数据库快速建库方法。首先将区域网格化:针对某发射台站,确定发射台站经纬度信息,并以其为中心,以q角度为间隔形成辐射路径。按照步长Dd等分各路径,获取各等分点的经纬度信息;然后获取路径参数信息:通过长波地理信息系统,基于各等分点的经纬度信息,获取路径参数信息,包括高程h、大地电导率s、相对介电常数er,形成路径参数数据库;最后根据获得的数据,并行计算各点的ASF。本发明基于GPU平台,利用积分方法的迭代过程实现了快速计算发射台站周围ASF修正值,大大缩短了计算时间。
📄 2020116368540
📂 G01C21_20
👤 西安理工大学
📅 2020-12-31