本说明书涉及智能物流技术领域,涉及基于MAPPO算法的多AGV路径规划模型训练方法、路径规划方法。该模型训练方法包括:使用结合循环神经网络和策略梯度算法的MAPPO算法,对多AGV动作策略进行参数化,并对参数进行优化,使AGV选择奖励更大动作的概率变大,得到奖励较多的多AGV动作路径。该路径规划方法包括:对单个AGV进行全局路径规划,然后基于全局路径规划,使用多AGV路径规划模型对多个AGV动作过程中的路径冲突进行消解,得到多个AGV动作的最佳路径。本说明书的基于MAPPO算法的多AGV路径规划模型训练方法和路径规划方法,能够高效准确地完成多AGV工作情况下的路径规划,能在复杂环境下保证AGV的实时避障,提高货物运输效率,降低成本。
📄 2023116458606
📂 G05B19_418
👤 浙江工业大学
📅 2023-12-04