摘要
本发明公开了一种基于时态均衡分析的多智能体多任务连续控制方法,包括步骤:基于时态逻辑构建多智能体多任务博弈模型,进行时态均衡分析并合成多智能体顶层控制策略;构建规约自动补全机制,通过增加环境假设完善有依赖关系的任务规约;构建顶层控制策略与底层深度确定性策略梯度算法的连接机制,并基于此框架构建多智能体的连续任务控制器。本发明基于时态逻辑捕捉任务的时态属性,通过规约补全提高系统规约的可解释性以及可用性,并将其生成顶层抽象任务表征并将其应用于底层的连续系统的控制,解决了多智能体多任务连续控制上存在的可扩展性差、易陷入局部最优、奖励稀疏等实际问题。