Residual PPO with rule-based priors for multi-UAV cooperative approach and terminal operations.
reinforcement-learning uav robotics deep-reinforcement-learning actor-critic autonomous-systems proximal-policy-optimization ppo multi-agent-reinforcement-learning multi-uav rule-based-control residual-reinforcement-learning parameter-sharing
-
Updated
Aug 23, 2026 - Python