论文精读|MOO:基于预训练视觉-语言模型的开放世界物体操作MOO利用预训练视觉-语言模型将自然语言指令与视觉物体定位相结合,实现了对从未见过的物体类别的零样本操作泛化,在真实机器人上达到约79%的成功率。