论文精读|MOO:基于预训练视觉-语言模型的开放世界物体操作

MOO利用预训练视觉-语言模型将自然语言指令与视觉物体定位相结合,实现了对从未见过的物体类别的零样本操作泛化,在真实机器人上达到约79%的成功率。

2026年7月28日 · 1 分钟 · 151 字 ·