摘要
本发明涉及一种基于机器学习的蓝莓产量预测方法,属于农作物产量预测技术领域。该方法包括:S1:生成模拟数据集:S2:数据预处理;S3:利用XGBoost选出最优特征子集;S4:构建基学习器,包括随机森林、梯度提升决策树、支持向量机;S5:构建多模型融合的Stacking集成学习元模型:选择Stacking模型集成策略将三种经过优化的基学习器作为模型第一层,将第一层基学习器的输出作为第二层元学习器的输入进行再训练,得到完整的模型;S6:评价元模型预测性能;S7:验证元模型;S8:计算特征重要性程度。本发明解决了农业系统中数据采集困难的问题,能够快速预测蓝莓产量,减少采集数据样本,提高预测精度。