运动先验重塑:让平地四足技能适应复杂地形论文提出分层强化学习框架:低层策略先在平地模仿犬类动作并形成运动先验,高层目标条件策略输出潜在步态指令与受约束关节残差,使 ANYmal-D 在楼梯、坡面、随机箱体和高障碍中保持自然动物风格步态,并完成感知运动、局部避障与目标导航。Zewei Zhang, Chenhao Li, Takahiro Miki·2025年5月21日ANYmal四足机器人运动先验2025年5月21日