资讯
李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界
📋总体概括
李飞飞创办的World Labs正式发布其首个多模态世界模型Atlas,采用从零开始预训练的路线,号称仅需几张图像就能构建出可交互的3D世界。这与其之前基于视频生成世界状态的做法不同,转向更底层的原生世界建模,被视为空间智能路线的关键落子,直接对标以语言模型为核心的主流AI范式。
⚡关键信息
- ▸李飞飞旗下公司发布首个多模态世界模型Atlas,主打空间智能方向
- ▸Atlas采用从零预训练,不依赖已有大模型底座
- ▸官方称只需几张图像即可构建一个3D世界
- ▸该模型延续李飞飞提出的空间智能理念,与纯语言模型路线形成差异化竞争
🔥犀利点评
李飞飞在赌一个判断:语言模型堆不出物理世界理解,空间智能才是下一个范式。几张图生成3D世界技术上确实惊艳,但演示视频和真实可用之间隔着鸿沟——别忘了此前RS的生成世界也曾被质疑只是好看不好用。从零预训练意味着烧钱周期更长,如果不能尽快找到游戏、机器人等变现场景,故事讲得再美也撑不住资本耐心。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文 →