钛媒体9月14日报道,李飞飞创办的World Labs发布新一代世界模型Atlas,官方称其为“全球首个”能同时处理文字、图片、视频和3D的多模态世界模型。
据原文,Atlas的demo可喂入两三个视角的照片,重建出整个场景,并让镜头飞到从没人站过的位置。
原文称,传统3D重建依赖密集拍摄和多角度、高覆盖率图像采集,对设备、时间和人力要求极高。Atlas依托大模型先验知识与生成能力,仅需少量普通手机拍摄的图像,就能实现高保真3D重建。
材料还提到,Atlas通过构建可交互、可推演的“世界模拟器”,将AI生成能力拓展至机器人领域,即Real-to-Sim。
