Notice: Undefined index: HTTP_ACCEPT_LANGUAGE in /mnt/wwwroot/nokov.new/public/public_base.php on line 14
IROS 2025 多智能体深度强化学习算法实现Crazyflie无人机在复杂环境中协同追逐-度量科技 | NOKOV度量动作捕捉
English 日本語 Русский

IROS 2025 多智能体深度强化学习算法实现Crazyflie无人机在复杂环境中协同追逐

IROS 2025 多智能体深度强化学习算法实现Crazyflie无人机在复杂环境中协同追逐

客      户
国防科技大学智能科学学院周晗老师团队

国防科技大学智能科学学院周晗老师团队在国际机器人顶会IROS 2025上发表题为”Emergent Cooperative Strategies for Pursuit-Evasion in Cluttered Environments: A Knowledge-Enhanced Multi-Agent Deep Reinforcement Learning Approach” 的论文。该论文提出了一种面向复杂环境多智能体追逃的知识增强深度强化学习方法,并通过大量数值仿真和真实实验验证了本文方法的效率和优越性。NOKOV度量动作捕捉系统为真实实验提供Crazyflie无人机位置和速度数据,助力验证本文算法的有效性。

 

研究背景

为增强多智能体系统在协同追逐任务中的自主性和适应性,无模型深度强化学习 (DRL) 作为一种有前景的方案受到了越来越多的关注。然而,大多数现有基于DRL的追逐方法仍依赖个体奖励,并且在复杂场景中表现不佳。

 

本文贡献

为了在复杂环境中促进具有感知限制的追逐者之间的协作行为,本文提出了一种基于团队奖励的知识增强多智能体延迟深度确定性策略梯度 (KE-MATD3) 算法。主要贡献总结如下:

1、提出了一种基于团队奖励的 MADRL 方法,用于在杂乱环境中进行多智能体协同追逐,其中任务被建模为去中心化的部分可观测马尔可夫决策过程。

2、引入了一种知识增强 (KE) 机制,利用改进的人工势场法 (IAPF) 的见解,从而促进了具有挑战性的团队奖励的学习。

3、通过仿真和物理实验验证了追逐者之间协作行为的出现。

 合作追逐任务的系统框架

合作追逐任务的系统框架。(a) 多智能体追逐-逃避环境。(b) 本文提出的 KE-MATD3 算法。

 

数值仿真实验

在数值模拟中,本文算法(KE-MATD3)通过与多种基线算法(如 MATD3MADDPGMADDQN 及其变体)的比较,验证了其优越性。

结果显示,本文算法利用知识增强机制,显著提升了学习效率和最终性能,实现了最高的捕获成功率和最低的碰撞率。

在不同障碍物密度下,本文算法始终保持最佳性能,展现出强大的泛化能力。这表明本文算法能有效促进复杂环境中的协同行为,实现高效的目标捕获。

 

真实世界实验

6.4×11×2 m实验场地中,包含5Crazyflie 2.1四轴飞行器、NOKOV度量光学动捕捕捉系统、20 个圆柱形障碍物(半径20 cm,高1 m)和机载计算机。

物理实验结果

物理实验结果

NOKOV度量动作捕捉系统实时输出Crazyflie无人机的高精度位置和速度数据,通过ROS实时传输到机载计算机。

真实实验表明,本文方法能安全有效地完成捕获任务,同时实现追逐者之间的涌现式协同行为。

物理实验结果 - 视频

NOKOV度量动作捕捉系统为真实实验提供多架Crazyflie无人机位置和速度数据,助力验证本文算法的有效性。

 

作者简介

孙懿豪,国防科技大学智能科学学院,博士研究生,主要研究方向为无人机集群分布式决策技术

闫超,南京航空航天大学自动化学院,副研究员,博士,主要研究方向为深度学习、多智能体强化学习、无人集群协同控制与智能决策

周晗,国防科技大学智能科学学院,副教授,博士,主要研究方向为无人系统协同控制

相晓嘉,国防科技大学智能科学学院,研究员,博士生导师,主要研究方向为无人系统技术

姜杰,中国运载火箭技术研究院,中国科学院院士,博士生导师,主要研究方向为导航制导与控制、运载火箭总体设计


微创手术如何让连续体机器人"全身跟着路径走"? 东南大学团队TASE 同心管机器人曲率域连续转向方法研究

东南大学宋爱国、朱利丰教授团队TASE 2025 论文提出同心管机器人曲率域连续转向方法,让刚度主导型同心管机器人沿复杂自由曲线持续逼近目标路径。物理实验中 NOKOV 度量动作捕捉完成机械臂与支气管解剖模型的相对位姿标定,把仿真规划和真实世界数据对齐。

AAV 集群如何在复杂环境中自适应围捕多个目标?

国防科技大学 IEEE RA-L 论文案例:DB-PGM 让 AAV 集群无需预定义编队和显式通信,即可在障碍物环境中自适应围捕多个目标,多架无人机在目标运动、障碍物和个体故障同时存在时,仍能保持协同,并通过NOKOV度量动作捕捉系统进行位姿跟踪完成真实飞行闭环验证。

IEEE RA-L | 机载RGB实现水下目标主动跟踪,动捕支持AUV闭环验证

哈工深国际人工智能研究院胡靓教授团队在IEEE RA-L上提出 UTracker 水下目标主动跟踪框架,仅凭机载 RGB 图像生成局部航点。NOKOV度量水下动作捕捉系统实时提供 AUV 位姿,用于将局部航点转换至全局坐标,并通过 MAVROS 转化为控制指令发送至 AUV 自动驾驶仪执行,支持真实水池闭环运行与 Sim-to-Real 验证。

叠衣服过程中的手部精细操作数据采集,NOKOV度量动作捕捉系统实时追踪

通过NOKOV度量动作捕捉系统实时追踪叠衣服过程中双手的手部精细动作。操作者佩戴设置反光标记点的手套,在布置光学动作捕捉相机的场地中采集高精度手部动作数据,为精细操作、机器人操作研究及动作数据采集提供支持。
联系我们
如需更多应用、案例信息或产品报价,请致电 010-64922321,或在下方留言:
机器人/无人机 VR/AR/XR 运动康复 传媒娱乐
北京度量科技有限公司(总部)
Location 北京市朝阳区安慧里四区15号五矿大厦8层820室
Email info@nokov.com
Phone 010-64922321
提交成功!请您耐心等待!
欢迎关注公众号,获取更多信息
关闭