一龍馬/AI 情報站讀懂消息背後的脈絡
星期三
搜尋

World Labs 發表 Atlas,稱其為從頭預訓練、原生處理文字、影像、影片與 3D 的多模態自迴歸擴散 Transformer,可進行世界生成、空間重建與時空模擬

中文摘要

官方展示包括以一至六張參考圖控制攝影機路徑、產生最長 1 分鐘的 1440p 影片,以及從稀疏影像生成新視角或明確 3D 輸出;但這些效能與「超越專用 3D 重建模型」均為公司自述,來源未提供可獨立核驗的完整評測。Atlas 尚採申請早期存取,團隊也在 HN 回應,場景動態與時間一致性仍有改善空間。

一龍馬判讀

若稀疏影像重建與精準運鏡能在實務中成立,影視製作、數位孿生及機器人 Real-to-Sim 工作流程可共用同一套模型;目前的主要風險是成果以精選展示為主,而且模型補出的遮蔽區域只是合理想像,不等同真實重建。

原文節錄

Hacker News · johnsutor

Atlas: A World Model for Spatial Intelligence | World Labs About Research & Insights Marble Labs Community Showcase Case Studies Learn API Spark Join Us

取得部分原文 · 不代表內容已獨立查證

查看原文 閱讀社群討論
完整收錄文字與來源

Atlas: A World Model for Spatial Intelligence

收錄日期
2026-09-02
來源
Hacker News Firebase API
抓取時間
2026/09/02 05:40(台北)
來源資料
95 分 · 16 則討論