摘要
本发明涉及一种基于MPI并行化的参考点k近邻分类方法,属于数据分类领域。该方法包括步骤:S1:基于参考点的k近邻算法利用样本点到若干参考点的距离来度量彼此间的位置差异,定义位置差异因子,计算训练样本到参考点的相似度,并产生有序的相似度序列;S2:根据测试样本与参考点的相似度从有序序列中搜索训练集中近似近邻样本;S3:从搜索到的近似近邻样本中计算与测试样本的确切相似度,从而找到k个近邻样本并判断类别。本发明借助参考点来加速k近邻的查找并将使用MPI技术实现并行化,从而加快大规模、高维度数据的分类速度。