CHC5 第五代开源相机平台基于 Zynq-7000 SoC,FPGA 直接运行 ISP 图像流水线(黑电平校正、去马赛克、自动曝光/白平衡等),峰值约 6 亿像素/秒,支持 640×480@2000FPS、1080p@170FPS、4K@40FPS。
韩国 ROBOTIS 团队的 OH! GYM 项目:学生们通过仿真训练与真机迁移,让人形机器人完成障碍跑、跆拳道、K-POP 舞蹈与跑酷等高动态动作,展示 sim-to-real 全身控制能力。
参观机器人与物理AI企业展厅,实地了解多个场景的机器人演示。
清华AIR提出Zetta ζ闭环具身框架:冻结基础VLA策略,在线进化代码化的运行时评审器与恢复技能,机器人可检测失败、任务中恢复并复用成功经验。LIBERO-Pro成功率31%→90.8%,推理提速11.1倍。
ETH RSL 让人形机器人只靠头部固态激光雷达原始回波完成跳上云梯、臂行横越、跳下落地的完整序列:三个特权教师经相位调度蒸馏为一个注意力感知学生,配合电池压降、电机热极限与雷达噪声建模,硬件 15 次成功 14 次,臂行速度 0.5 m/s。
Ongan, Efe, Zhang, Chong, Sun, Boyang
TrapVLA 能在 VLA 模型上触发精确的失败模式——过早闭合夹爪、按指定偏移抓取、到达目标前张开、或在设定位置释放。它学习的是引发故障的微小动作残差,而非记忆固定攻击模式,为具身操作策略的鲁棒性评估提供了新视角。
Holiday Robots展示先进触觉传感器,让人形机器人感知画笔接触,突出精细力觉与灵巧操作能力。
DART以无训练方式将SAM3转化为实时开放词汇多类检测器,COCO 80类达55.8 AP,并支持Jetson边缘部署。
Riemann Dynamics 发布 Riemann-1.0 World Action Model,使用超过 20 万小时人类第一视角视频,并结合夹爪数据与机器人轨迹,面向通用机器人的跨场景操作、世界模拟与动作生成。
针对无约束图像集合重建中剧烈外观变化与瞬态遮挡物两大难题,WilLaGS提出统一框架:用β-VAE学习连续的全局外观流形,由潜变量条件化的3D神经外观场生成动态Tri-Plane特征,建模空间变化的局部光照;再用自监督Teacher-Student(EMA)感知掩码自动识别并抑制瞬态区域。在Photo Tourism与NeRF-OSR上全面刷新纪录:Sacre Coeur场景PSNR达25.84 dB,比最强对手AsymGS高2.28 dB;单场景训练仅0.9 GPU小时,渲染58 FPS,并支持外观迁移、插值与无条件外观合成。
Yuhao Bai, Qianqiu Tan, Lilong Chen
论文将抓取算法生成的 25 个候选点转化为可退出的探索目标,用任务、探索和正则三个价值头解耦强化学习信号,并在 5000 到 10000 步之间调度优势权重。完整方法在椅子运输仿真中达到 94.1% 成功率和 4.4% 倾翻率,真机零样本完成 40/58 次未见 IKEA 物体运输。
Simone Tolomei, Mayank Mittal, Franco Angelini
Koala gripper 是一套协同设计系统,将手持数据采集设备和机器人夹爪结合,让单人操作员可以轻松记录任务演示。设备具备三个可控自由度与力优化触发器,用于降低灵巧操作和机器人演示数据采集门槛。