World Labs发布Atlas:几张照片就能重建一个可漫游的三维世界

AI资讯4分钟前发布 EdgeClaw
1 00

World Labs发布Atlas:几张照片就能重建一个可漫游的三维世界

只用几张随手拍的照片,能不能在数字世界里重建出一个真实可感的空间?2026年9月2日,由AI科学家李飞飞参与创立的World Labs给出了答案——正式发布全球首个多模态世界模型Atlas。

什么是世界模型,Atlas强在哪里

传统3D建模需要扫描设备、专业软件和大量人工,而Atlas走的是另一条路:它把图像、视频、文本等多种信息放在同一个架构里处理,从零完成预训练,能够生成符合相机控制要求的像素级画面,并对生成内容进行3D维度重建。换句话说,给它几张照片,它就能”脑补”出完整的三维空间。

李飞飞公开披露了Atlas的多项核心能力:仅靠单张输入图像就能完成大型场景重建;对视频重新构图实现时空模拟;从单张或多张输入图像直接原生输出3D空间;还能把不同姿态的多张图像整合成一个完全自洽的3D世界。

从照片重建三维空间的数字城市全息模型,蓝紫光效,World Labs Atlas世界模型重建概念图

从Marble到Atlas:世界模型的进化路线

其实这已经不是World Labs第一次交出作品。此前团队已经推出过3D世界生成产品Marble,主打单图生成可探索场景。而Atlas在Marble的基础上实现了质的跨越:它不只是”生成一个场景”,而是把世界生成、空间重建和时序模拟融进了同一个模型体系,属于真正意义上的”空间智能”尝试。

谁能用上Atlas:VFX、机器人都在等

在官方口径里,Atlas被描述为”目前表现最优的相机条件世界模型”,覆盖的落地场景相当广。影视特效(VFX)行业可以用它快速搭建虚拟场景、做镜头重构,省下大量实拍和建模成本;机器人领域则可以借助它对空间的理解能力,让机器人在虚拟环境里先”看懂”房间结构,再迁移到真实世界执行任务。游戏、自动驾驶仿真、室内设计等方向同样有想象空间。

为什么”用照片重建世界”如此重要

过去几年,大模型在语言和图像理解上突飞猛进,但对”空间”的理解一直是个短板。AI要真正走进物理世界,就必须学会判断物体远近、遮挡关系和空间布局。Atlas把这个问题摆到了台面上:当模型能从零散的二维照片里还原出连贯的三维结构,AI距离”理解世界”就更近了一步。

机械手托举全息地球与城市网格,暗调科技风,展示Atlas三维空间重建与时空模拟能力

当然,Atlas目前仍是早期产品,生成精度、复杂场景的还原度还需要更多实测检验。但方向已经清晰:空间智能正在从概念走向可用。接下来要关注的,是这套模型会以什么形态开放给开发者,以及它能否在真实项目中跑通工作流。可以确定的是,AI的战场已经从”看懂一张图”延伸到”重建一个世界”。

© 版权声明

相关文章