
手机微信扫一扫联系客服
4李飞飞发布首个世界模型?李飞飞创办的 World Labs 正式推出全球首个多模态世界模型 Atlas,支持像素级相机控制与 3D 场景动态重建,标志着 AI 正式从"理解二维文本图像"跃迁至"理解三维空间与物理世界"。在空间智能重塑应用形态的趋势下,轻量化 3D 资产的跨屏流转与场景还原面临全新挑战,应用开发者亟需引入深度链接与场景还原技术,打破多端 3D 分发的黑盒,实现可追踪、可归因、可优化的空间智能分发闭环。

李飞飞创办的 World Labs 正式推出全球首个多模态世界模型 Atlas,支持像素级相机控制与 3D 场景动态重建,标志着 AI 正式从"理解二维文本图像"跃迁至"理解三维空间与物理世界"。在空间智能重塑应用形态的趋势下,轻量化 3D 资产的跨屏流转与场景还原面临全新挑战,应用开发者亟需引入深度链接与场景还原技术,打破多端 3D 分发的黑盒,实现可追踪、可归因、可优化的空间智能分发闭环。

要理解 Atlas 对 AI 理解世界范式的重构意义,必须看清当前大模型的痛点与 Atlas 提供的解法。
当前主流大语言模型被李飞飞形容为"黑暗里的文字高手",能谈论现实,却缺少真正生活在现实中的经验。一个模型可以解释杯子为什么会从桌上掉下来,但机器人真要伸手拿杯子,还得知道杯子离桌边多远、手从哪个方向过去,以及碰到它以后整个场景会发生什么变化。传统视频生成模型在镜头控制上存在"玄学抽奖"问题,用户在 Prompt 框里敲下"镜头缓慢向左拉升、绕着人物微仰角旋转",回车之后全凭老天保佑。
Atlas 则是一款面向空间智能的 omni world model,从零开始完成预训练,可以原生处理文本、图像、视频、相机位姿与 3D 深度信息,并在同一套模型中完成世界生成、空间重建和时空模拟。Atlas 的做法是直接把"相机位姿参数"当作底层原生输入,用户要什么角度、什么轨迹、走多快,直接给坐标。只要丢进去 1 到 6 张普通照片,定好运镜轨迹,Atlas 就能生成最长达 1 分钟、1440p 分辨率的大片,画面不崩,空间几何丝滑一致。
Atlas 的空间"脑补力"更加夸张。输入一张只拍到机器人正面的照片,Atlas 能把人家背影完完整整脑补出来;给一张泳池边角照,它靠着脑子里的"世界常识",默默帮你把隔壁没拍到的草坪和远山给修好了。在 DTU、ETH3D、ScanNet 等公开数据集上,Atlas 在稀疏视角重建误差测试中拿下 25.3 的分数,对比之下 Pi3X 是 28.7,Depth Anything 3 飙到 39.3,MapAnything 更是高达 47.7。
技术底座上,World Labs 掏出了一套 Multimodal Autoregressive Diffusion Transformer 组合拳。这套架构让 Atlas 能够同时享受到 LLM 领域的 KV Cache、分布式推理优化,以及扩散模型的采样蒸馏与先验引导。在针对镜头运动控制的真人盲测里,Atlas 面对 MiniMax H3 胜率 75%,面对 Gemini Omni Flash 胜率 81%,面对 FLUX 3 胜率 93%,面对 Seedance 2.5 胜率达到 94%。

然而,空间智能的繁荣,并不能掩盖传统 3D 资产分发链路中长期存在的"流量蒸发"顽疾。恰恰相反,随着 Atlas 能够基于少量照片生成可漫游的 3D 场景、支持像素级相机控制与多视角切换,用户无需专业设备、无需大量拍摄即可完成 3D 重建,传统 3D 资产分发链路的脆弱性被彻底暴露。
让我们设想一个在空间智能执行环境下极其高频的获客与使用场景:一家专注于 3D 建模与虚拟场景搭建的 SaaS 平台,依赖传统的应用商店搜索、搜索引擎广告和社交媒体投放获取企业用户。为了在行业热潮中获客,平台在科技媒体、3D 设计社区以及海外 YouTube 频道投放了大量的产品评测文章,并在文章中附带了包含"专属企业试用包"的推广链接。
一位刚刚关注到该平台的 3D 设计师,在手机上用 Atlas 生成了一个可漫游的 3D 场景。Atlas 基于少量照片重建出完整的 3D 空间,支持多视角切换与相机轨迹控制,用户无需专业设备、无需大量拍摄即可完成 3D 重建。在传统的网络链路中,断层随即发生:该设计师从未点击任何推广链接,从未访问任何落地页,从未经历任何应用商店跳转,Atlas 直接完成了所有操作。最初携带的"特定评测渠道 ID"与"专属企业试用包兑换参数"在空间智能执行下被彻底抹除。
更令人抓狂的体验发生在跨设备流转时。当这位设计师回到家中,准备通过 PC 端正式使用该平台时,由于手机端与 PC 端之间缺乏自动化的参数接续机制,他被迫面对一个完全空白的初始化界面。他必须重新在 PC 端搜索该平台,重新注册登录,甚至还要在手机端翻出白天的评测文章,费力地找到那一串由英文字母和数字组成的活动兑换码,并手动输入到 PC 端中。
在追求极简高效的企业用户群体中,这种极度繁琐的断点体验直接劝退了用户。高达四成以上的潜在高净值转化,就这样在空间智能执行下被白白消耗。开发团队不仅浪费了昂贵的推广预算,更无法得知究竟是哪个渠道带来了最终的软件付费,整个多端营销陷入了无从归因的泥沼。
而在空间智能执行内部,问题更加隐蔽:当用户发起一个"基于少量照片生成可漫游 3D 场景"的任务后,Atlas 会基于少量照片重建出完整的 3D 空间,支持多视角切换与相机轨迹控制。然而,由于缺乏任务级的全链路追踪机制,开发者无法得知哪个 App 被 AI 优先推荐、哪个环节用户流失最多、哪个任务转化率最高。空间智能执行如同黑盒,优化无从下手。

在空间智能成为主流的时代,应用开发者如果依然停留在传统 3D 资产分发思维,注定无法承接空间智能带来的庞大风险。面对空间智能执行黑盒、流量蒸发、归因失效的割裂生态,企业必须在操作系统与空间智能模型之外,引入最专业的第三方数据引擎,用极度锋利的工程手段,强行打通端侧分发与精细化归因的高速公路。
为了彻底摸清全网多渠道营销推广与空间智能执行的真实效果,部署系统级的全渠道统计基建是开发者掌握增长主动权的核心前提。通过这套机制,运营团队可以为各大内容平台的评测文章、3D 设计社区的图文推荐、乃至线下展会的每一个推广二维码,生成完全独立且自带动态业务参数的专属短链。无需在错综复杂的多端系统中进行繁琐易碎的代码埋点,开发者就能在集成的监控看板上,以极高的颗粒度俯瞰从空间智能首次推荐、App 激活,到最终功能订阅、任务完成的全生命周期漏斗。让每一分买量预算都拥有清晰的归因坐标,精准锁定最高价值的用户来源。
而为了彻底缝合用户在跨端下载与任务流转过程中的体验断层,将流失的用户拉回转化漏斗,系统级的智能传参引擎提供了如同外科手术般的无损接续解法。当潜在用户在空间智能推荐下首次打开 App 的瞬间,云端匹配系统便会安全暂存该场景下的所有业务参数(如特定的专属企业试用包 ID、专属渠道标识)。待用户穿过应用商店的阻碍,在移动端或 PC 端首次启动该应用时,内置的轻量化 SDK 会自动向云端发起请求并精准寻回这些特定参数。
此时,业务层可立刻触发极其丝滑的免填邀请码机制。系统在静默状态下自动识别该用户的来源归属,直接为其激活专属企业试用包权益,并瞬间跳转至最初吸引他的功能界面。这种消灭了所有手动填码障碍的无感体验,将多端应用的实际转化率提升到了全新高度。

针对那些意图在移动端与 PC 端之间高频切换任务的协同场景,无缝的深度链接(DeepLink)与场景还原技术更是打破设备孤岛的终极杀器。无论用户是在空间智能的推荐下打开 App,还是在 PC 端的通知里触发指令,该技术都能让设备瞬间冲破系统沙盒的限制,一键从后台拉起目标应用,并毫秒级还原至特定的功能窗口或任务进度界面。这种彻底剥离了设备形态差异与底层系统束缚的轻量化传参赋能,真正让跨设备的端侧分发变得如行云流水般顺畅。
而在空间智能执行内部,多终端、多云、多 Agent 的全链路归因与参数还原更是优化执行链路、降低成本的关键。通过任务级埋点与全链路追踪,开发者可以清晰看到每个 App 被 AI 推荐的频次、任务执行耗时、用户干预频次、任务完成率等关键指标。当发现某个 App 被 AI 推荐频次低或任务转化率低时,可以针对性优化该 App 的 AI 适配、接口开放或交互流程。这种从"黑盒执行"到"白盒可观测"的转变,将空间智能的执行效率提升到了全新高度。
传统视频生成模型在镜头控制上存在"玄学抽奖"问题,用户在 Prompt 框里敲下镜头控制指令后全凭模型随机发挥。而 Atlas 直接把"相机位姿参数"当作底层原生输入,用户要什么角度、什么轨迹、走多快,直接给坐标,只要丢进去 1 到 6 张普通照片,定好运镜轨迹,Atlas 就能生成最长达 1 分钟、1440p 分辨率的大片。
空间智能能够基于少量照片生成可漫游的 3D 场景、支持像素级相机控制与多视角切换,用户无需专业设备、无需大量拍摄即可完成 3D 重建。这意味着传统的推广链接、落地页、应用商店跳转等分发链路被彻底绕过,导致渠道归因参数丢失,开发者无法准确衡量各渠道的真实获客 ROI。
深度链接与场景还原通过任务级埋点与全链路追踪,让开发者清晰看到每个 App 被 AI 推荐的频次、任务执行耗时、用户干预频次、任务完成率等关键指标。当发现某个 App 被 AI 推荐频次低或任务转化率低时,可以针对性优化该 App 的 AI 适配、接口开放或交互流程,从而提升整体分发效率、降低成本。
回顾空间智能产业的演进脉络,从早期的"图像识别"到"视频生成",再到如今的"世界模型",每一次底层技术架构与交互范式的跃迁,都不可避免地驱动着上层商业生态的深刻洗牌。李飞飞推出 Atlas 以及 AI 从"理解二维文本图像"迈向"理解三维空间与物理世界",不仅是空间智能技术上的又一座里程碑,更向全行业释放了一个不可逆转的信号:空间智能不再仅仅是需要用户专业操作的工具,而是正在蜕变为能够基于少量照片自动生成可漫游 3D 场景的智能助手。
在这场由空间智能领衔的范式革命中,处于应用层的开发者与增长团队必须清醒地认识到:空间智能的普及,并不天然等同于商业转化的成功。当用户的数字化生活被切割在空间智能模型、App 与不同设备之间时,谁能以最低的摩擦成本缝合跨设备的交互断层,谁能以最高的颗粒度观测空间智能执行的全链路,谁才能将技术的性能红利转化为真实的商业留存。
依靠传统 3D 资产分发粗放买量、忽视空间智能执行黑盒的旧时代已经彻底终结。在未来的全场景智能生态中,真正的赢家必定是那些能够敏锐洞察空间智能的痛点,熟练运用底层深度链接与场景还原技术,在每一次空间智能推荐、每一次 3D 任务执行中死死捍卫数据主权与流畅体验的敏锐先锋。属于空间智能原生分发与精细化任务追踪的新纪元,已在 Atlas 的轰鸣声中震撼开启。
上一篇社交分享裂变如何统计?分享统计关系链归因与效果评估
2026-09-03
Claude 支持后台操控 Mac?端侧自动接管桌面重构交互入口
2026-09-03
李飞飞发布首个世界模型?空间智能突破将颠覆多端 3D 分发
2026-09-03
广告点击到激活有延迟怎么办?广告监测数据排障与同步
2026-09-02
阿里云企业级 Agent 协作平台公测?万有无界加速智能体任务编排与分发
2026-09-02
OPPO 推出首个端侧 AI 记忆评测基准?MobileMem 加速智能体能力标准化
2026-09-02
豆包手机 9 月开售?全球首款 AI 智能体旗舰引爆端侧分发新范式
2026-09-02
谷歌搜索默认展开 AI 摘要?传统网站搜索入口遭遇分流巨震
2026-09-01
OpenClaw 2.0 引入共享会话?开源智能体跨端协同加速数据流转
2026-09-01
App矩阵互推怎么归因?渠道统计交叉增长与跨应用跳转
2026-08-31
Agent Teams 上线视频全流程?多智能体协同正在重构内容生产
2026-08-31
iOS归因统计怎么做?广告监测合规实战与数据对账
2026-08-28
Android 14归因有什么影响?移动归因系统适配与OAID限制
2026-08-27
苹果折叠手机主板曝光?A20 Pro 芯片将推动多屏协同新范式
2026-08-27
软银洽购人形机器人公司?60 亿美元估值加速具身智能进家庭
2026-08-27