AI工具介紹:World Labs Atlas
World Labs 由著名 AI 學者飛飛(Fei-Fei Li)教授創立,該公司發布了全新一代空間智慧多模態世界模型 Atlas。Atlas 專為理解、重建與模擬三維空間而設計,將 AI 技術從傳統的二維影像生成,推進到具備完整空間結構與物理幾何規律的全新階段。
全方位多模態輸入支援
Atlas 採用全能多模態架構,能夠同時處理與結合文字描述、單張或多張平面圖片、動態影片、3D 幾何資料以及相機軌跡參數。使用者無論是透過簡單的文字構想,還是利用手邊的拍攝素材,都能輕鬆引導模型進行視覺創作。
精確的相機軌跡與鏡頭控制
與傳統 AI 影片生成工具不同,Atlas 支援將真實的相機幾何參數輸入系統。創作者可以精準設定鏡頭在三維空間中的位置、方向與移動路徑,生成高達 1440p 解析度、長達一分鐘且符合幾何一致性的高畫質影片。
強大的 3D 空間重建與圖像補全
僅需提供少量的普通照片或手機拍攝影片,Atlas 就能自動構建出完整的 3D 場景。對於鏡頭未拍到的死角或盲區,模型會發揮視覺想像力進行合理補全。甚至將兩張毫無關聯的圖片放在同一空間範圍內,Atlas 也能自動補齊中間的走廊或連接通道。
原生 3D 數據輸出
Atlas 不僅能輸出 2D 影片,還支援直接生成點雲(Point Clouds)與三維高斯潑濺(3D Gaussian Splatting)等顯式 3D 數據。這些資產可以無縫導入 Unity、Unreal Engine、Blender 或 Spark 等主流遊戲引擎與 3D 軟體中,大幅簡化影視特效與遊戲開發流程。
動態時間暫停與子彈時間效果
利用多角度拍攝的短影片,Atlas 具備讓時間暫停並自由旋轉視角的能力。創作者能輕鬆實現類似電影「子彈時間」的鏡頭效果,從原本攝影機未曾拍攝到的角度重新渲染畫面。
數位雙生與機器人模擬
在具身智能與機器人領域,Atlas 具備 Real-to-Sim(真實到模擬)的能力。只需輸入一段手機影片,系統就能重建大規模環境,並即時模擬機器人在該空間移動時,其搭載鏡頭所觀察到的 RGB 影像與深度數據(Depth Data),為機器人訓練提供高質量的合成數據。
影視特效與動畫製作:精準控制鏡頭軌跡,快速生成高幾何一致性的場景與特殊視角運鏡。
遊戲開發與 3D 資產製作:迅速將 2D 概念圖轉換為可導出的 3D 點雲與 Gaussian Splatting 資產,減少模型建置時間。
機器人訓練與具身智能:自動生成包含不同光影、背景與物體擺設的模擬空間,加快機器人演算法的訓練與驗證循環。
虛擬實境與建築設計:從少量現場照片快速復原實體空間,生成 360 度全景與虛擬導覽體驗。
Atlas 目前處於早期測試階段,尚未全面公開開放。有興趣體驗或將其整合至工作流程中的開發者、企業與研究團隊,可以前往 World Labs 官方網站填寫申請表單加入等候名單。官方也表示,未來 Atlas 的技術將逐步整合至旗下的 Marble 平台與 World API 中,持續為空間智慧領域提供強大的基礎模型支援。