
只用 3 部固定在三脚架上的 iPhone德州pvc管粘接胶水厂家,Atlas 就能重现《黑客帝国》式的“子弹时间”,让镜头绕着凝固的动作移动。
这是 World Labs 新发布的世界模型 Atlas 展示的能力之。据 DeepTech 此前报道,这是全球个多模态世界模型。它能以像素精度控制镜头,根据参考图生成长 1 分钟、 1,440p 的,还可用 1 张至数十张图像重建真实空间,输出新视角画面和显式 3D 结果。
近日,World Labs 联创始人李飞飞、Justin Johnson 和 Ben Mildenhall 做客 a16z Show,与主持人 Martin Casado 讨论 Atlas。谈话从设计选择展开,也回顾了团队由多模态世界模型 Marble 转向 Atlas 的过程。
对谈中,团队将 Atlas 的核心能力称为“新视角预测”。区别于般模型沿时间轴预测下帧,Atlas 能够根据已有画面与相机位姿等,判断镜头移动到另个时空位置后会看到什么。
李飞飞认为,生成具有空间语境和现实依据的像素,是通往空间智能的步。这种能力既能帮助创作者维持场景与物体的致,也可能把现实环境转成机器人训练所需的模拟空间。
谈及后续路线,团队计划增强模型对动态变化和场景编辑的支持,并探索与机器人行动规划的结,使其从呈现三维世界逐步走向理解和参与其中。
预测个未被拍下的视角
对谈从 Atlas 如何生成、重建和模拟世界出发。据 World Labs 团队介绍,Atlas 在预训练阶段共同处理文本、图像、、相机位姿和 3D 信息德州pvc管粘接胶水厂家,并将其编码为“空间上下文”。每张图像都关联着三维相机位姿,位置和朝向得到明确标记。
除了相机参数,Atlas 还把度图作为原生输入。RGB 图像记录某个位置看上去是什么样,度图则描述物体与相机之间的距离,帮助模型判断前后遮挡和空间结构。换句话说,模型处理的不只是连续画面,还包括画面背后的三维关系。
李飞飞提到,计机视觉发展半个多世纪以来,像素生成、识别和三维重建通常分属不同研究向。Atlas 以视点和相机位姿估计为锚点,把像素生成与像素重建放进同个模型,使两类任务可以在套架构中相互配。
在她看来,空间智能终需要支持生成、理、编辑和交互,而理解空间的几何、结构与物理规律是实现这些任务的基础。Atlas 可以估计每帧对应的视角和相机位姿,使生成的像素受到空间语境和几何关系约束,因而构成了这条路径上的个阶段。
针对 Marble 与 Atlas 的差异,联创始人 Justin Johnson 解释,为便于在移动设备和游戏引擎中渲染,上代多模态世界模型 Marble 主要以斯泼溅表示三维场景。但由于模型的所有结果都须先落到这种表示上,从而限制了其他输出。
针对这问题,Atlas 进行了些调整,即将不同模态早分开,把“新视角预测”放在基础的位置。模型先根据空间上下文生成指定视角的 RGB 画面或度信息,需要明确的三维表示时,再生成斯泼溅场景。换句话说,斯泼溅不再是所有任务都须经过的终点,而成为模型可按任务调用的种输出形式。
此外,Atlas 还试图降低三维重建对密集拍摄的依赖。Ben Mildenhall 表示,传统法需要让每处表面至少出现在 3 至 4 个视角中,拍摄个房间可能需要 100 至 300 张照片。Atlas 有望将数量降到约 3 张,相当于减少 50 至 100 倍。
输入数量大幅减少后,模型要面对的考验是如何补足相机从未拍到的区域。李飞飞提到,在斯坦福校园的次演示中德州pvc管粘接胶水厂家,模型接收的 3 至 25 张照片全部从地面拍摄,却生成了校园上空的俯瞰画面。她指出,保温护角专用胶空中视角并非来自原始素材,而是在已知空间关系约束下生成的结果。
这案例也再次说明了两类任务为何需要相互配。尽管密集重建可以利用大量拍摄素材已被镜头捕捉到的区域,但难会遗漏桌底、麦克风下和椅腿之间等区域,Atlas 则能够“看到”这些细节。
在谈及团队如何确认这技术路径时,李飞飞回忆道,2026 年初夏,个小于当前版本的模型处理 NeRF 论文中的花园桌场景后,给出了此前未曾见过的桌下视角,出现了只足球。
正是这次对新视角预测能力的关键验证,三位创始人决定继续进这向。此后,模型随着规模、训练时长和芯片数量增加而持续。
让空间进入真实工作
新视角预测已经回答了模型如何建立连贯空间,但若想让这个空间能够被创作者反复修改或用于设计,接下来的问题便是如何让它成为真实工作流程的部分。
在前代模型 Marble 的使用中,创作者常先生成三维场景,再从不同位置截取画面,作为后续制作的素材。Atlas 希望把这过程收进同空间,让用户直接指定视角并继续生成所需镜头。这样来,场景中的人物、道具和位置关系可以延续到下步创作。
这种连续也正是业工作流所需要的德州pvc管粘接胶水厂家,例如影视、游戏和营销项目要保留场景与布局以便修改,建筑、施工和展台制作也要把口头意见和草图落实到三维软件中。
Ben Mildenhall 表示,希望模型降低反复修改的负担,保留控制精度的同时使三维设计接近搭积木或用铅笔勾画。
当场景可以从现实素材中被重建和修改,李飞飞又将它放入机器人研发的工作链。2026 年 7 月,World Labs 收购机器人公司 SceniX,补上了从现实环境重建、到模拟训练、再回到现实部署的技术链。
通过 Atlas 对真实场景进行重建并生成可调整的模拟环境,开发者可以在其中采集训练数据、训练机器人策略,并在部署前评估不同动作可能带来的结果。
李飞飞认为,机器人当前的主要瓶颈是数据。线缆弯曲式、容器尺寸和颜、物体摆放位置都可能变化,训练环境需要呈现这些差异,机器人才有机会应对部署时的不同情况。Atlas 可以将真实环境快转入模拟,再改变其中的条件,补充难以逐采集的训练情形。
不过,要训练机器人策略,模拟环境不能只停留在静态画面的复现。当机器人策略采取动作,环境还可能以意料之外的式响应,训练就需要覆盖尽可能多的异常与失败情形。
Justin Johnson 表示,除人工编写规则的传统物理引擎外,团队还在探索“经模拟器”,让模型从数据中学习环境面对不同动作时可能发生的变化。
此外,真实世界始终处于变化之中,模型还需要处理时间维度。针对 Atlas 动态能力,World Labs 团队表示,模型架构和预训练数据本已包含动态信息。不过,当前版本的后训练主要聚焦静态场景和空间移动,团队计划在后续版本中继续增强对时间变化的处理。
谈及未来规划,李飞飞认为,空间智能需要越看见和解释场景,形成感知、体验与交互的闭环。她将其视为从空间生成迈向保真模拟、场景编辑和行动规划的向,使模型进步支持人和机器在空间中行动。
参考资料:
1.https://www.youtube.com/watch?v=qn1QDDBnTA0
2.https://www.worldlabs.ai/blog/atlas#spatial-reconstruction
3.https://www.worldlabs.ai/blog/atlas#robotics-simulation
运营/排版:何晨龙
注:封面/图由 AI 辅助生成
相关词条:罐体保温 塑料挤出设备 钢绞线 超细玻璃棉板 万能胶
奥力斯 pvc管道管件胶批发 联系人:王经理 手机:15226765735(微信同号) 地址:河北省任丘市北辛庄乡南代河工业区
1.本网站以及本平台支持关于《新广告法》实施的“极限词“用语属“违词”的规定,并在网站的各个栏目、产品主图、详情页等描述中规避“违禁词”。
2.本店欢迎所有用户指出有“违禁词”“广告法”出现的地方,并积极配合修改。
3.凡用户访问本网页,均表示默认详情页的描述,不支持任何以极限化“违禁词”“广告法”为借口理由投诉违反《新广告法》,以此来变相勒索商家索要赔偿的违法恶意行为。
