mult_uav_ppo_case

这是一个基于 PyTorch 实现的连续动作空间 PPO(Proximal Policy Optimization)算法,专门用于多智能体(无人机/无人车)强化学习环境(MPE - Multi-Agent Particle Environment)。

// repository documentation