Dynamic Decoupling-Driven Cooperative Pursuit for Multi-UAV Systems: A Multi-Agent Reinforcement Learning Policy Optimization Approach
Lei Lei, Chengfu Wu, Huai‐Min Chen · Computers, materials & continua/Computers, materials & continua (Print) · 2025
This paper proposes a Multi-Agent Attention Proximal Policy Optimization (MA2PPO) algorithm aiming at the problems such as credit assignment, low collaboration efficiency and weak strategy generalization ability existing in t... | Find, read and cite all the research you need on Tech Science Press