资讯

李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界

InfoQ中文·2026/9/3 16:49:43🔗 原文

📋总体概括

李飞飞创办的World Labs发布其首个多模态世界模型Atlas,主打从零开始预训练,号称仅需几张图片即可构建可交互的虚拟世界。该模型延续了其空间智能(Spatial Intelligence)路线,试图让AI直接理解并生成三维世界结构,而非仅生成二维图像,被视为空间智能赛道从概念走向产品的标志性一步。

关键信息

  • 李飞飞首个多模态世界模型Atlas正式发布,延续其World Labs的空间智能技术路线
  • Atlas采用从零开始的预训练方式,而非基于现有大模型微调改造
  • 官方称仅需几张图片输入即可构建出虚拟世界,大幅降低三维场景生成门槛
  • 发布由媒体InfoQ报道,正文未披露参数规模、评测数据与商业落地细节

🔥犀利点评

几张图生成一个世界,听着炫,但关键问题一个没答:生成的三维世界能否持久编辑、物理是否自洽、算力成本几何?从零预训练是态度不是护城河,空间智能这条赛道上谷歌、英伟达都在卡位,李飞飞抢的是概念首发权。产品真伪与工程可用性,还得等第三方上手验证,别急着封神。

本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文