摘要
本发明涉及数据存储分类处理技术领域,具体涉及基于金融文本数据分类存储方法及系统,该方法包括:获取各金融文本数据中各词汇的词向量,记为各节点;基于夹角以及模长获取任意两个节点之间的距离度量;根据上下文信息以及节点在句子中的出现情况获取任意两个节点之间修正后的距离度量;采用聚类算法,根据修正后的距离度量获取金融文本数据的各初始连通图;基于各节点在连通子图中的密度分布构建连通子图的承受系数阈值,得到优化后的各聚类子簇;基于各聚类子簇内的节点获取金融文本数据的关键词,采用神经网络实现金融文本数据的分类存储。本发明旨在提高金融文本数据中关键词提取的精度,实现金融文本数据分类存储。