182: 对话梁琛奇:抖音、猫箱、创业,「他们都搞生产力,我想用 AI 创造开心」
梁琛奇在訪談中分享其從字節跳動到創立動念引線的創業歷程,探討如何用 AI 創造娛樂體驗而非僅限於生產力。他認為推理成本下降與模態進化是關鍵,並提出漫畫形式因壓縮資訊量更易在 AI 時代獲得使用者接受,旨在探索讓大眾主動創作的未來娛樂形態。
依發布時間
梁琛奇在訪談中分享其從字節跳動到創立動念引線的創業歷程,探討如何用 AI 創造娛樂體驗而非僅限於生產力。他認為推理成本下降與模態進化是關鍵,並提出漫畫形式因壓縮資訊量更易在 AI 時代獲得使用者接受,旨在探索讓大眾主動創作的未來娛樂形態。
World Labs 創辦人 Justin Johnson 在 Podcast 中介紹 Atlas,這是世界首款能生成、重建與模擬的多模態世界模型。
薩姆·奧爾曼坦回應 OpenAI 因模型能力過快提升而暫停前沿訓練,並提出 RSI 進展越快 IPO 應越遲的反常識觀點。內容涵蓋安全對齊調整、Astra 模型突破與算力策略,探討超級智慧時代人類生活與隱私立場。
訪談邀請了智象未來創始人梅濤院士,深入探討從圖片到影片、再到世界模型的技術演進路徑。梅濤分享了他團隊如何從圖片模型切入,利用龐大資料量構建影片生成模型,並展望未來語言、影片與具身智慧將匯聚成世界模型的終局。
訪談深入探討 Sora 與 Seedance 之後,影片生成模型(Video Agent)的發展路徑、資料生態與技術挑戰。
訪談探討 AI 代理已佔全球網路請求超過半數的現象,並分析 Microsoft 推出 trillion-parameter 混合專家模型 MAI-Thinking-1 與 MAI-Image-1 的市場意涵。
實測 Google 新推出的 Gemini Omni 影片生成模型,能保留使用者聲音與外貌,將 10 秒影片轉換為不同場景或風格。同時介紹 Gemini Avatar 數位分身功能,透過自拍照建立可重複使用的 AI 形象。
訪談釐清世界模型的概念分類與現狀,並深入探討輝達 GEAR 團隊的 DreamDojo 與 DreamZero 研發歷程。內容解析了由世界模型、策略模型與 Agent 構成的自進化迴圈機制,說明其如何突破物理限制以最佳化具身智慧策略。
探討大型語言模型與駕馭工程能否通往通用人工智慧,並分析世界模型如何補足對物理世界理解的不足。內容涵蓋 AI 詐騙防護、開發者體驗痛點,以及 Yann LeCun 提出的 JEPA 架構與 LeWorldModel 新突破,最後預測未來可能…
Moonlake 創辦人 Chris Manning 與 Fan-yun Sun 探討如何建立具備因果推理、多模態互動且高效的世界模型。
探討 Seedance 如何利用抖音海量使用者資料與工程化優勢,在文生影片領域超越 Sora 與 Veo。透過對比測試,揭示其精準卡點與電影級質感的差異,並分析中國公司如何透過「搶奶茶」等場景落地實現 AI 普及。
回顧 2025 年 AI 領域的劇烈變化,涵蓋 GPT-5.2 等前沿模型的加速迭代、開源模型如 DeepSeek 的衝擊,以及資料中心能源瓶頸與物理機器人等新趨勢。
訪談測試 OpenAI 最新推出的 GPT-5.2 模型,發現其無法識別明顯的「連續殺人犯」文字,且在工具呼叫與複雜任務上表現不佳。
探討 ChatGPT Atlas 如何將大型語言模型置於瀏覽器核心,讓使用者能以自然語言指令完成搜尋、購物與複雜任務。講者分享了從傳統瀏覽器到「代理式」瀏覽器的轉變,並示範了滾動標籤頁等實用功能。
Sora 核心團隊成員分享產品如何從原型演變為 App Store 排名第一的應用,並探討「 Cameo」功能的意外成功。他們談到小團隊如何應對技術挑戰、內容審核,以及將 AI 影片模型視為世界模擬器以推動科學突破的願景。
Brad Gerstner 專訪 Satya Nadella 與 Sam Altman,深入解析 OpenAI 與 Microsoft 的戰略合作架構、營收分成機制及排他性協議。
介紹 VAE、Flow、Diffusion 與 GAN 等經典影像生成模型的原理與差異,並深入解析 Sora 如何利用 Diffusion Transformer 結合雜訊去除技術生成影像。
由李宏毅講授,深入解析生成式 AI 如何產生圖片與影片,涵蓋從視覺語言模型到 Sora 背後的原理。內容說明如何利用深度學習自動提取特徵,並透過多階段生成策略提升畫質與幀數,同時探討影像生成在 VTuber 與影像修復等領域的應用。
深入探討利用擴散模型生成影片的研究現狀,涵蓋從基礎參數化到不同架構(如 3D U-Net、DiT)的技術細節。讀者可學習影片生成面臨的時序一致性挑戰,並了解 VDM、Imagen Video、Sora 等主流模型的設計原理與實作策略。
依人氣
探討 ChatGPT Atlas 如何將大型語言模型置於瀏覽器核心,讓使用者能以自然語言指令完成搜尋、購物與複雜任務。講者分享了從傳統瀏覽器到「代理式」瀏覽器的轉變,並示範了滾動標籤頁等實用功能。
訪談探討 AI 代理已佔全球網路請求超過半數的現象,並分析 Microsoft 推出 trillion-parameter 混合專家模型 MAI-Thinking-1 與 MAI-Image-1 的市場意涵。
深入探討利用擴散模型生成影片的研究現狀,涵蓋從基礎參數化到不同架構(如 3D U-Net、DiT)的技術細節。讀者可學習影片生成面臨的時序一致性挑戰,並了解 VDM、Imagen Video、Sora 等主流模型的設計原理與實作策略。
World Labs 創辦人 Justin Johnson 在 Podcast 中介紹 Atlas,這是世界首款能生成、重建與模擬的多模態世界模型。
薩姆·奧爾曼坦回應 OpenAI 因模型能力過快提升而暫停前沿訓練,並提出 RSI 進展越快 IPO 應越遲的反常識觀點。內容涵蓋安全對齊調整、Astra 模型突破與算力策略,探討超級智慧時代人類生活與隱私立場。
實測 Google 新推出的 Gemini Omni 影片生成模型,能保留使用者聲音與外貌,將 10 秒影片轉換為不同場景或風格。同時介紹 Gemini Avatar 數位分身功能,透過自拍照建立可重複使用的 AI 形象。
梁琛奇在訪談中分享其從字節跳動到創立動念引線的創業歷程,探討如何用 AI 創造娛樂體驗而非僅限於生產力。他認為推理成本下降與模態進化是關鍵,並提出漫畫形式因壓縮資訊量更易在 AI 時代獲得使用者接受,旨在探索讓大眾主動創作的未來娛樂形態。
探討 Seedance 如何利用抖音海量使用者資料與工程化優勢,在文生影片領域超越 Sora 與 Veo。透過對比測試,揭示其精準卡點與電影級質感的差異,並分析中國公司如何透過「搶奶茶」等場景落地實現 AI 普及。
訪談釐清世界模型的概念分類與現狀,並深入探討輝達 GEAR 團隊的 DreamDojo 與 DreamZero 研發歷程。內容解析了由世界模型、策略模型與 Agent 構成的自進化迴圈機制,說明其如何突破物理限制以最佳化具身智慧策略。
Sora 核心團隊成員分享產品如何從原型演變為 App Store 排名第一的應用,並探討「 Cameo」功能的意外成功。他們談到小團隊如何應對技術挑戰、內容審核,以及將 AI 影片模型視為世界模擬器以推動科學突破的願景。