科研实习
软件智能体协作、具身群体智能与科学发现的研究主题示意

依托复杂关键软件环境全国重点实验室

ADMIRE 课题组

研究复杂环境中的自适应智能体群体,让智能系统具备记忆、学习、推理、协作和持续进化能力。

北京航空航天大学 · ADMIRE

GROUP & PLATFORM

课题组与依托平台

ADMIRE 课题组依托北京航空航天大学复杂关键软件环境全国重点实验室开展研究。

依托平台

复杂关键软件环境全国重点实验室

实验室面向国家重大需求,以支撑大型复杂装备和空天地实时系统的复杂关键软件为研究对象,围绕开发效率、质量保障与持续演化等关键问题开展研究。

重点研究方向包括:复杂系统机理及软件理论、群体智能与群体软件工程、软件可信保障与质量评估、软件运行支撑与持续演化。

课题组定位

从 Software Agents 到 Agentic Scientist

在这一研究背景下,ADMIRE 课题组聚焦复杂环境中的自适应智能体群体,沿软件空间、物理/具身空间和科学发现空间三条主线展开研究。

课题组探索智能体的学习、推理、协作与持续演化机制,形成面向软件系统、无人系统和科学发现的关键技术与系统框架。

MAPE-K 闭环 Agentic Mesh UAV 群体智能 ScienceOS / AI4Sci
200㎡

高标准室内试验场地,集成高精度光学动捕系统

100PFLOPS+

GPU 集群服务器算力,支撑高强度仿真与训练

30+

国家重点研发计划、国家自然基金重点等课题基础

OUR TEAM

团队成员

团队学术带头人

吴文峻教授

北京航空航天大学人工智能研究院教授,博士生导师,长期带队推进大模型、多智能体系统、群体智能和具身智能相关研究

  • 国家人工智能标准总体组副组长
  • 国家信标委人工智能分委员会模型算法标准研究组组长
  • 国家科技创新2030新一代人工智能重大项目总体组专家
  • 国务院学位委员会智能科学与技术学科评议组专家

RESEARCH AREAS

课题组研究方向

课题组围绕软件空间、物理/具身空间和科学发现空间开展研究,形成了面向复杂环境的自适应智能体群体关键技术与系统框架。

01 Software Space

软件空间中的群体智能

把微服务、业务流程和软件运维看作可观测、可回滚、可审计的智能体协作环境,研究 Agentic Mesh、服务组合、智能运维和根因定位。

  • 自然语言目标到可执行服务流程:规划、检索、执行、聚合、监督。
  • 快慢结合的运维智能体:监控信号、知识图谱、调用链和 LLM 推理协同定位故障。
  • 智能体记忆、反馈和原位进化,让 Prompt、Workflow、Policy 和 Skill 持续优化。
Agentic Mesh 服务组合 RCA Agents
02 Physical Space

物理空间中的具身群体智能

面向无人机、机器人和无人系统,把大模型的高层认知与多智能体强化学习、物理先验、安全约束和真实环境反馈结合起来。

  • 从稳定控制、团队共识到路径规划与空间推理,支撑可部署的多机器人协作。
  • 利用对称性、势场、Lyapunov 稳定性等数学物理先验提升训练效率与安全性。
  • 用 LLM 智能体自动生成奖励、组织训练、封装模型并推动仿真到真实迁移。
UAV Swarm MARL Sim-to-Real
03 Scientific Discovery

科学发现空间中的 Agentic Scientist

把科学问题转化为可验证的智能体工作流,让理论、计算、实验和反馈形成闭环,支撑科学计算、AI4Sci 与实验自动化。

  • Scientific Theory、Computing、Experiment Agents 分工协作,完成文献、假设、仿真和实验设计。
  • 面向 PDE 求解、流体仿真等任务,构建检索、计划、代码生成、执行与纠错闭环。
  • 结合 ScienceOS、智能计算平台和机械臂/多模态实验设备,探索可复现的科研自动化。
ScienceOS AI4Sci PDE Agents

RECENT OUTPUTS

课题组科研成果

近年成果覆盖软件智能体、具身群体智能和科学计算智能体三条主线

软件空间中的群体智能

围绕服务组合、工作流调度、软件质量与智能运维,研究从运行数据感知、故障定位到智能体协同修复和经验复用的完整闭环。

物理空间中的具身群体智能

面向无人机、机器人与多智能体协作,把结构先验、强化学习、神经算法推理和语言模型结合到可部署的感知—决策闭环中。

科学发现空间中的 Agentic Scientist

研究知识增强、图学习和推理训练方法,为科学智能体理解问题、组织计算过程并形成可验证的推理链路提供基础能力。

论文索引

共 20 篇

2026

UrbanNav: Learning Language-Guided Embodied Urban Navigation from Web-Scale Human Trajectories

具身智能、城市导航、语言引导导航

CCF A · AAAI 2026
2026

TAS-DAQ: Task-Adaptive Sparse Prediction with Dense Query Auxiliary Supervisory for Efficient 3D Object Detection

3D 目标检测、稀疏预测、多模态感知

CCF A · TMM 2026
2025

C-NAV: Towards Self-Evolving Continual Object Navigation in Open World

具身智能、开放世界导航、持续学习

CCF A · NeurIPS 2025
2024

Soft Knowledge Prompt: Help External Knowledge Become a Better Teacher to Instruct LLM in Knowledge-based VQA

多模态问答、知识增强、LLM

CCF A · ACL 2024
2024

GraphRARE: Reinforcement Learning Enhanced Graph Neural Network with Relative Entropy

图神经网络、强化学习、异质图学习

CCF A · ICDE 2024
2024

Leveraging Partial Symmetry for Multi-Agent Reinforcement Learning

多智能体强化学习、对称先验、群体智能

CCF A · AAAI 2024
2023

Deep Bayesian Active Learning for Learning to Rank: A Case Study in Answer Selection (Extended Abstract)

主动学习、排序学习、答案选择

CCF A · ICDE 2023
2023

CLGT: A Graph Transformer for Student Performance Prediction in Collaborative Learning

教育数据挖掘、协作学习、图 Transformer

CCF A · AAAI 2023
2026

MemOcc: Hierarchical Memory for Indoor Continuous Occupancy Mapping

具身智能、连续占据建图、层次记忆

IEEE ICRA
2026

Agents Trainer: Automatically Training Multi-Agent Reinforcement Learning Models for Drone Swarm Using Language Model-Based Agents

大模型智能体、多智能体强化学习、无人机群体

IEEE T-ASE
2026

REMIX: Reusable Experience Memory for Adaptive Web Service Composition

用可复用经验记忆支持服务组合智能体适应任务与运行环境变化。

CCF B · WISE 2026 · Accepted
2026

FLARE: Causal Fault Localization and Minimal Repair for Web Service Composition with LLM Agents

以 LLM 智能体完成服务组合中的因果故障定位,并生成尽可能小的修复方案。

CCF B · WISE 2026 · Accepted
2026

TopoEvo: A Topology-Aware Self-Evolving Multi-Agent Framework for Root Cause Analysis in Microservices

融合调用拓扑和多模态信号,通过多智能体协作与持续演化定位微服务根因。

CCF B · IEEE ICWS
2026

STAR: A Stage-attributed Triage and Repair framework for RCA Agents in Microservices

按诊断阶段追踪 RCA 智能体的错误来源,并对推理过程进行定位和修复。

CCF B · IEEE ICWS
2025

GRACE: A Strategic LLM-Enhanced Graph Reinforcement Learning Framework for Adaptive Fault Recovery in Microservice Systems

结合大模型、图强化学习与恢复策略,实现微服务故障后的自适应处置。

CCF B · ICSOC 2025
2025

CoE-Ops: Collaboration of LLM-based Experts for AIOps Question-Answering

组织多个大模型专家协同回答 AIOps 问题,融合不同角色的运维知识和推理能力。

arXiv 2025
2025

BERT4Anno: An Annotation Misuse Detection Method for Java

利用预训练语言模型理解 Java 注解语义与上下文关系,检测潜在的注解误用。

CCF B · Information and Software Technology
2025

SC-COO: A Feedback-Based Service Composition Algorithm Combining Offline and Online Reinforcement Learning

结合离线学习与在线反馈,在动态环境中持续优化服务组合决策。

Applied Intelligence
2024

HMSC-LLMs: A Hierarchical Multi-Agent Service Composition Method Based on Large Language Models

采用分层多智能体结构分解复杂需求,并利用大模型协同完成大规模服务组合。

CCF B · WISE 2024
2024

Graph-Based Ensemble Learning for Enhanced Fault Localization in Microservices

通过图表示与集成学习融合多类运行信号,提高微服务故障定位的稳定性。

IEEE SMC 2024
2023

An Automatic Model Management System and Its Implementation for AIOps on Microservice Platforms

面向微服务 AIOps 自动组织模型的训练、部署和生命周期管理。

The Journal of Supercomputing
2023

Integrating Cognition Cost With Reliability QoS for Dynamic Workflow Scheduling Using Reinforcement Learning

在动态工作流调度中联合考虑认知成本与可靠性 QoS,并用强化学习优化选择。

CCF A · IEEE TSC 2023
2022

MicroEGRCL: An Edge-Attention-Based Graph Neural Network Approach for Root Cause Localization in Microservice Systems

用边注意力图神经网络建模微服务依赖关系,从复杂故障传播中定位根因。

CCF B · ICSOC 2022
2022

Dependable Workflow Scheduling for Microservice QoS Based on Deep Q-Network

利用深度 Q 网络为微服务工作流选择兼顾可靠性与服务质量的调度方案。

CCF B · IEEE ICWS 2022
2022

API Misuse Detection Method Based on Transformer

通过 Transformer 建模 API 使用上下文,识别可能引发软件缺陷的调用模式。

IEEE QRS 2022
2021

Parallelizing Automatic Model Management System for AIOps on Microservice Platforms

通过并行化模型管理流程提升微服务 AIOps 中自动分析任务的处理效率。

Euro-Par Workshops 2021
2020

Workflow Recommendation Based on Graph Embedding

把工作流及其组件关系编码为图表示,为服务流程提供结构感知的推荐。

SERVICES 2020
2020

Multi-Indicators Prediction in Microservice Using Granger Causality Test and Attention LSTM

结合因果检验与注意力时序模型预测微服务指标,为异常预警提供支持。

SERVICES 2020
2020

Learning to Handle Exceptions

通过神经网络学习 Java 代码中的异常处理模式,预测 try 块位置并生成 catch 处理代码,辅助开发者完善程序异常处理。

CCF A · IEEE/ACM ASE 2020
2026

Structural entropy guided hierarchical symmetric multi-agent reinforcement learning

群体智能、层次对称性、多智能体强化学习

Expert Systems with Applications
2026

Offline constrained policy optimization with safe anchoring

离线强化学习、安全约束优化

Neural Networks
2025

Lyapunov-Informed Multi-Agent Reinforcement Learning for Multi-Robot Cooperation Tasks

Lyapunov 稳定性、多机器人协作、多智能体强化学习

IEEE T-ASE
2025

Symmetry-Informed MARL: A Decentralized and Cooperative UAV Swarm Control Approach for Communication Coverage

对称先验、无人机群体控制、通信覆盖

IEEE TMC
2025

Neural Algorithmic Reasoners informed Large Language Model for Multi-Agent Path Finding

大模型、神经算法推理、多智能体路径规划

IJCNN
2024

Exploiting Hierarchical Symmetry in Multi-Agent Reinforcement Learning

层次对称性、等变策略、多智能体强化学习

ECAI
2024

AdaptAUG: Adaptive Data Augmentation Framework for Multi-Agent Reinforcement Learning

自适应数据增强、多智能体强化学习

ICR
2024

Hierarchical Consensus-Based Multi-Agent Reinforcement Learning for Multi-Robot Cooperation Tasks

分层共识、多机器人协作、多智能体强化学习

IROS

代表论文与核心架构

代表论文 3 篇 · 核心框架 1 项

专利成果

面向智能运维与微服务系统的关键技术

OPEN SOURCE & DEMOS

开源项目与演示

面向无人机导航与群体协同,开放研究代码、评测基准与实验演示。

纯视觉导航 · 多模态模型 · MIT

VoLN-UAV

以目标视图和场景视觉线索驱动无人机长程导航,提供模型训练、闭环评测代码,以及数据集和仿真环境入口。

多机协同 · 大模型任务编排 · MIT

AeroWeaver

整合无人机状态观测、技能调度、编队控制与自然语言任务规划,支持人工操作和大模型驱动两种模式,以及 AirSim、PX4/Gazebo 等仿真适配。

实验平台

虚实融合、群体协同、机器人操作与外场实景

空地协同虚实融合验证平台

三维仿真、集群状态观测与实物场景联合验证

多智能体协同控制实验平台

多智能体仿真与室内无人机编队协同实验

城市沙盘空地协同实验平台

城市道路与建筑沙盘中的无人机、地面车辆实验

具身智能与机器人实验平台

双臂操作、协同导航、自主探索与四足运动控制

空地异构集群外场试验平台

无人机集群部署、无人车实物与机群返场

无人机导航与群体协同实验

课题组综合实验展示

RESEARCH INFRASTRUCTURE

科研条件与平台支撑

课题组依托全国重点实验室开展研究,科研工作由算力集群、室内试验场地与无人系统等条件支撑,覆盖软件智能体、具身群体智能和科学计算,并与国内外高水平团队保持长期科研合作。

COLLABORATION NETWORK

国内外合作

课题组与新加坡国立大学、南洋理工大学及意大利米兰理工大学保持长期国际合作,并与上海人工智能实验室、中关村实验室、乾元实验室和启元实验室开展联合研究,持续推进科研协作与博士生联合培养。

新加坡国立大学 · 南洋理工大学

围绕智能体、多机器人协作、群体智能与大模型等方向保持合作交流,组内多位学生曾赴新加坡开展学术访问与合作研究。

Singapore

国内实验室合作

与上海人工智能实验室、中关村实验室、乾元实验室和启元实验室保持长期合作,围绕软件智能体、大模型安全、具身智能与复杂智能系统开展联合研究,并推进博士生联合培养。

China

意大利米兰理工大学

面向复杂系统、智能决策与交叉科学问题保持稳定合作交流,组内博士、博后曾赴该校开展合作研究。

Italy

ACADEMIC EXCHANGES

国内外交流

国际会议、学术访问与科研合作

PROJECTS

课题组承担项目

课题组承担多项国家重点研发与自然基金项目,科研经费充足,总计数千万元

国家重点研发计划工业与信息化部智能服务适配理论与关键技术2019-2022
国家自然科学基金重点国家自然科学基金重点在线大规模协同学习的机理与方法研究2016-2020
国家重点研发计划国家石油天然气管网集团有限公司全时域高响应超大规模流体管网智能决策系统2025-2027
国家自然科学基金浙江大学基于新型架构的行业大模型研究2025-2026
国家重点实验室自主课题华为有限公司科学计算及流体仿真套件技术2022-2023
国家重点实验室自主课题中航技进出口有限责任公司大数据量实时计算运价业务微服务框架支撑课题技术服务项目2023-2024
国家重点实验室自主课题国网江苏电力有限公司业务中台智慧运营关键技术研究及应用2022-2024
国家重点实验室自主课题中国民航信息网络股份有限公司研发中心基于大语言模型辅助的微服务接口开发关键技术研究课题技术服务2025-2026

INTERNSHIP

科研实习

课题组开放本科生科研实习,欢迎对相关研究方向感兴趣的同学了解并申请。

1 准备一页简历
写清您的项目、代码或竞赛经历
2 选择一个方向
从软件空间、物理/具身空间、科学发现空间中选择您感兴趣的入口
3 填写问卷进行报名
点击"直接报名"填写问卷即可完成报名

实验平台