摘要
本发明提出一种基于强化学习的网络流量灰色预测方法,包括如下步骤:首先采用公开网络流量数据集,并截取部分公开数据集作为待预测流量序列;然后构建基于GM(1,1)灰色预测的强化学习模型:基于每一个时间步长,智能体获得当前环境状态,并根据策略函数生成动作,环境在执行动作后,将当前环境状态更新,同时将动作的奖励值反馈给智能体,智能体根据更新的环境状态和奖励值生成下一个动作,直到达到预设迭代次数,获得基于GM(1,1)的强化学习模型。最后利用强化学习模型输出最终预测结果。本发明将强化学习的决策能力与灰色模型的小样本、定量预测优势相结合,旨在提高传统灰色预测模型的预测精度。