影片高階中文3.9 萬 次觀看
李飞飞发布最新世界模型Atlas | World Labs | 世界模型 | 3D重建 | 视频生成 | 空间智能 | 高斯泼溅 | 机器人仿真 | 多模态AI
看影片(在新分頁開啟原站)連到 Best Partners TV
摘要
李飛飛創立的 World Labs 發布新一代多模態世界模型 Atlas,能從單張照片生成新視角、用少量圖片重建 3D 場景,並支援機器人模擬。該模型透過空間上下文架構統一處理文字、影像、影片與 3D 資料,被視為世界模型從生成畫面走向建立空間的重要一步。
World Labs unveils Atlas, a multimodal world model capable of camera-controlled generation, 3D reconstruction, and robot simulation via a spatial context architecture.
摘要、重點與章節標題由語言模型整理,細節(誰說的、數字、先後)可能有誤;要引用請以原始內容為準。
重點
- Atlas 能接收相機位置與角度,直接生成指定視角的畫面。
- 僅需少量圖片即可重建真實世界的 3D 場景與空間結構。
- 可將真實環境轉化為模擬環境,用於訓練與測試機器人。
章節
依話題轉折切分,標題由 AI 產生
提到的工具與公司
- Atlas
- Marble
- RTFM
- SceniX
適合誰看
專注於多模態 AI、3D 重建、空間智慧或機器人模擬的研發人員與工程師。
摘要依據
- 依據
- 人工字幕
為什麼排在這裡
- 人氣
- 0.74
- 新鮮
- 0.90
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- World Models, Robotics, and the Future of 3D AIPodcast ・ The a16z Show ・ 24 分鐘
- World Models and the Future of Spatial AI with Justin Johnson - #775Podcast ・ The TWIML AI Podcast ・ 1 小時 6 分
- Genie 3: An Infinite World Model with Shlomi Fruchter and Jack Parker-HolderPodcast ・ Google DeepMind: The Podcast ・ 57 分鐘
- 80.与梅涛院士的 3 小时访谈:语言、视频、具身终将汇聚,为什么是世界模型?Podcast ・ 卫诗婕|漫谈 Light the Star ・ 3 小時 22 分
- Moonlake: Causal World Models should be Multimodal, Interactive, and Efficient — with Chris Manning and Fan-yun SunPodcast ・ Latent Space ・ 1 小時 7 分
- How Physical AI Learns Across Language, Video and Action — Ming-Yu LiuPodcast ・ Machine Learning Street Talk ・ 26 分鐘
摘要由 AI 根據原文產生,可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)
