多机空战决策的表示解耦与角色建模进展

本期文献围绕高对抗、强动态场景下的自主与人机协同决策展开,方法侧以多智能体强化学习为主干,辅以Transformer、图注意力、注意力机制与分层策略;场景侧出现了若干新环境与任务设置,包括支持异构机型与跨机型迁移的开源超视距空战环境、5-vs-5胜率评测、以目标价值评估为核心的任务,以及带通信延迟的分布式控制验证。以下按问题相近度分组梳理。

表征解耦与角色建模

多机空战决策的一个共同痛点是共享编码器把合作与对抗表征混在一起,同时固定输入架构难以适配可变的智能体数量。REMP( https://doi.org/10.1007/s44443-026-01157-9 )针对这三点给出组合方案:角色专属专家模块为自身、友方、敌方分别配置独立编码器以解耦潜在表征,缓解梯度干扰与特征同质化;多尺度位置编码用傅里叶特征映射缓解频谱偏差,提取对战术机动关键的细粒度3D空间特征;两者嵌入置换等变Transformer骨干以支持可变数量智能体的关系推理。在5-vs-5对抗基于规则的专家时,报告胜率90.7%、全歼率62.3%、交换比0.21。

DRG-MAPPO( https://arxiv.org/abs/2609.11155v1 )从另一个角度切入角色问题。它先构建战场交互的图表示,用图注意力机制提取友军、敌军与威胁之间的关键关系特征;高层策略通过动态角色分配机制确定“leader”“supporter”等战术职责,低层策略以角色与图关系特征为条件执行离散机动动作,实现战术策略与协同执行的联合优化,并设计目标优先级辅助任务促进集火行为涌现。作者报告胜率87%,称达到state-of-the-art。两篇工作都把“谁在扮演什么角色”显式建模,区别在于REMP用角色专属编码器在表征层解耦,DRG-MAPPO用分层策略在决策层分配。

异构平台、环境与策略迁移

BVR Sim( https://arxiv.org/abs/2608.25419v1 )提供了这一方向的基础设施。它是开源Gymnasium风格环境,支持F-15、F-16、F/A-18、F-22等多种JSBSim机型,武器、传感器、控制器与对手均可配置。核心设计是统一的战术动作接口:在机型专属内环控制器之上指定期望航向、高度、速度与武器发射,使同一策略可跨异构平台运行。环境提供可互换的Python与加速C++后端、实体导向观测、组合式奖励、脚本对手、回放与可视化以及多智能体学习框架适配器。性能方面,C++后端在1-vs-1、0.4秒决策间隔下达到每墙钟秒104仿真秒的吞吐,场景规模可扩展至10-vs-10,并验证了跨机型迁移。

与之呼应的是两篇非方法类条目:通用原子FQ-42A协同作战飞机已与美空军有人战机共同飞行( https://www.twz.com/air/general-atomics-fq-42a-vengeance-cca-now-flying-together-with-usaf-fighters ),更真实的协同演示正在推进;Anduril向波兰推介两款无人机,用于配合波兰计划中的F-35与阿帕奇机队( https://www.defensenews.com/global/europe/2026/09/09/anduril-doubles-down-on-poland-with-autonomous-aircraft-pitch-for-f-35-apache/ )。此外,一篇概念框架论文提出以母型无人自主作战飞行器(MUACV)指挥多架无人作战与侦察机的协同中队架构( https://doi.org/10.61359/11.2106-2630 ),综合深度学习、深度强化学习、传感器融合、回归分析、优化、Transformer推理与自适应电磁隐身管理,并保留人类监督环节。

任务分配与协同建模

空天防御场景下的去中心化武器-目标分配有一篇注意力增强多智能体强化学习工作( https://doi.org/10.21203/rs.3.rs-10847429/v1 ),摘要信息有限,此处不展开。

有人-无人协同方面,一篇系统级建模论文提出基于冲突导向分析的MUT空战模型( https://doi.org/10.1088/1742-6596/3318/1/012011 ),形式化描述侦察、打击、压制敌方防空(SEAD)任务及空空交战,通过刻画机载系统的功能角色及其对任务结果的相互影响构建框架,支持交互模式的比较评估并识别对协同性能影响显著的关键系统组件。

延迟约束下的分布式控制

分布式模型扩散( https://arxiv.org/abs/2608.27685v1 )处理的是多智能体轨迹联合优化中的非线性、非凸性与维数灾难,以及智能体间通信延迟。方法为基于采样的模型预测控制,适用于高度非线性、非凸、非光滑多智能体系统,论文证明了多智能体非凸问题下的收缩性与对延迟的鲁棒性。在加入延迟的条件下,circleswap完工时间相比集中式Model-Based Diffusion改进31%,空战胜率相比集中式提升25%。

有限语料下的态势评估与方案生成

军事领域专业数据稀缺是这一组的共同约束。DECIS( https://doi.org/10.62762/tis.2026.310611 )是基于检索增强生成的自适应决策支持框架,三阶段架构围绕两项功能:用RAG将最优评估策略匹配到动态情境以缓解军事语料有限的问题,由LLM组件自主生成并优化目标列表以保证时效性与态势感知。在目标价值评估任务上报告的网络中心性类指标中,最大连通分量DECIS为0.6,PageRank为0.75,Betweenness Centrality为0.8。

另一条流水线工作( https://doi.org/10.1080/08839514.2026.2721301 )将LLM与结构化领域知识表示(知识图谱)结合,借助软件智能体实现合成观测的生成与处理,面向开放式态势感知与行动方案想定实验。其三项贡献为:面向LLM的知识表示综述并给出八阶段指导;AI应用采纳中的信任问题综述与指南;实现用于合成观测生成与处理的智能体式数据处理流水线。摘要未给出定量指标,关键发现是基础模型在结构化领域知识支持下能生成可供领域专家评估的输出,软件智能体使基于当前态势的潜在行动方案想定实验成为可能。

综述

认知电子战方向有一篇综述( https://doi.org/10.17134/khosbd.1909594 ),考察使无人机在非对称电子战威胁下自主维持连续控制任务的认知架构,讨论无人机连续控制任务与认知电子战的关系,针对每类任务给出文献中常用模型示例,并分析自适应控制机制在抵御网络物理操纵、保持飞行稳定性方面的作用。国防安全决策支持方向另有一篇综述,本期素材未提供其标题与链接,故不列出。

本期文献列表

  1. REMP: A transformer with role-specific experts and multi-scale positional encoding for autonomous multi-UAV air combat — https://doi.org/10.1007/s44443-026-01157-9
  2. AI Integration in Autonomous Collaborative Combat Unmanned Aircraft Squadron — https://doi.org/10.61359/11.2106-2630
  3. Decentralized Weapon-Target Assignment in Aerospace Defense Systems: An Attention-Enhanced Multi-Agent Reinforcement Learning Approach — https://doi.org/10.21203/rs.3.rs-10847429/v1
  4. DRG-MAPPO: Hierarchical Dynamic Role-Graph Multi-Agent Reinforcement Learning for Cooperative Air Combat — https://arxiv.org/abs/2609.11155v1
  5. A conflict-oriented model for coordinated manned-unmanned aerial teaming in complex operational environment — https://doi.org/10.1088/1742-6596/3318/1/012011
  6. BVR Sim: An Open and High-Throughput Environment for Heterogeneous Air-Combat Reinforcement Learning — https://arxiv.org/abs/2608.25419v1
  7. Cognitive Electronic Warfare In The Continuous Control Missions Of Unmanned Aerial Vehicles: A Comprehensive Review From An Artificial Intelligence Perspective — https://doi.org/10.17134/khosbd.1909594
  8. DECIS: An LLM-Based Value Assessment Framework for Targets — https://doi.org/10.62762/tis.2026.310611
  9. General Atomics FQ-42A Vengeance CCA Now Flying Together With USAF Fighters — https://www.twz.com/air/general-atomics-fq-42a-vengeance-cca-now-flying-together-with-usaf-fighters
  10. Anduril doubles down on Poland with autonomous aircraft pitch for F-35, Apache — https://www.defensenews.com/global/europe/2026/09/09/anduril-doubles-down-on-poland-with-autonomous-aircraft-pitch-for-f-35-apache/
  11. AI support for continuous open-ended situation awareness and scenario simulation: Design and early experiments in military intelligence — https://doi.org/10.1080/08839514.2026.2721301
  12. Distributed Model-Based Diffusion: Finite Horizon Contraction under Bounded Delay — https://arxiv.org/abs/2608.27685v1
posted on 2026-10-02 01:15  小蚂蚁xmy  阅读(11)  评论(0)    收藏  举报