资讯

李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界

InfoQ中文·2026/9/3 16:49:43🔗 原文

📋总体概括

李飞飞创办的World Labs正式发布其首个多模态世界模型Atlas,采用从零开始预训练的路线,号称仅需几张图像就能构建出可交互的3D世界。这与其之前基于视频生成世界状态的做法不同,转向更底层的原生世界建模,被视为空间智能路线的关键落子,直接对标以语言模型为核心的主流AI范式。

关键信息

  • 李飞飞旗下公司发布首个多模态世界模型Atlas,主打空间智能方向
  • Atlas采用从零预训练,不依赖已有大模型底座
  • 官方称只需几张图像即可构建一个3D世界
  • 该模型延续李飞飞提出的空间智能理念,与纯语言模型路线形成差异化竞争

🔥犀利点评

李飞飞在赌一个判断:语言模型堆不出物理世界理解,空间智能才是下一个范式。几张图生成3D世界技术上确实惊艳,但演示视频和真实可用之间隔着鸿沟——别忘了此前RS的生成世界也曾被质疑只是好看不好用。从零预训练意味着烧钱周期更长,如果不能尽快找到游戏、机器人等变现场景,故事讲得再美也撑不住资本耐心。

本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文