Emergent Cooperative Strategies for Pursuit-Evasion in Cluttered Environments: A Knowledge-Enhanced Multi-Agent Deep Reinforcement Learning Approach
复杂障碍环境中的追逃涌现协作策略:一种知识增强的多智能体深度强化学习方法
面向复杂障碍与有限感知条件下的多智能体追逃,提出基于团队回报的 KE-MATD3,并将改进人工势场的启发式知识作为软一致性约束注入策略优化,以缓解协作学习中的信用分配与局部最优问题。