介绍了智元机器人发布的一项名为GO-1的通用具身基座大模型,它采用了ViLLA架构(Vision-Language-Latent-Action),该架构由VLM和MoE组成,通过人类视频学习、小样本快速泛化、一脑多形和持续进化等特性降低了具身智能的门槛。
登录后参与评论
暂无评论
摘要不超过 300 字,结构化编号格式。可直接修改输入框内容。
可直接编辑输入框后点击「保存内容」;拉取通过境外 Jina 代理进行,可能需要 10-30 秒。