基于多智能体强化学习的协作跳长绳提出 Marope 多智能体强化学习框架,让多台 Unitree G1 人形机器人协作跳长绳:下层去中心化 MARL 学习摇绳操作,上层集中调度策略协调执行节奏,并融入多样跳跃策略提升对不同玩家风格的泛化,仿真与真机实验均优于基线。Zihao Wang, Shijie Peng, Kerui Wu·2026年6月6日MARLhierarchical RL宇树 G12026年6月6日