原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.11155
立即前往原文

DRG-MAPPO:面向协同空战的分层动态角色图多智能体强化学习

该研究提出 DRG-MAPPO,一种用于协同空战决策的多智能体强化学习框架。该方法通过图结构和图注意力机制,建模友军、敌军与威胁之间随时间变化的关系。分层策略动态分配“领导者”和“支援者”等战术角色,低层策略则根据角色信息和关系特征选择离散机动动作。此外,研究设计了目标优先级辅助任务,以促进集中火力等协同行为。在实验中,作者报告了 87% 的胜率。不过,这些结果仅限于所测试的仿真环境,尚不能证明该方法具备在真实空战系统中的作战能力。
行业资讯 应用 研究 2026-09-12 13:30:55 422 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。