聽節目(在新分頁開啟原站)連到 硅谷101
摘要
邀請Apodex兩位首席科學家杜少雷與李輩濱,探討AI自我進化的未來。他們指出,最快半年內AI即可跑通自我進化閉環,但持續可靠的遞迴提升仍需模型具備「自我驗證」能力,這類似人類科學家的基本功。Apodex定位為Heavy Duty Solver,專註解決人類尚未解決的難題,並透過多Agent互相驗證來確保模型不會跑偏。
This podcast episode features two leaders from Apodex discussing AI self-improvement. They reveal that AI can complete a self-improvement loop within six months, but sustained recursive improvement requires the model's ability to self-verify, akin to human scientists' rigorous methodology. Apodex, a…
重點
- 最快半年AI可跑通自我進化閉環,但需具備自我驗證能力。
- Apodex專註解決人類未解的難題,透過多Agent驗證防止模型跑偏。
- 自我進化是模型核心能力,從Deep Research到Coding均體現。
章節
依話題轉折切分,標題由 AI 產生
- 00:00Anthropic 承認 AI 自進化,AppleDex 專訪陳天橋首席科學家
- 03:40自我進化概念溯源:從語言模型最佳化器到 Age 概念
- 09:40「長城任務」定義:模型在無監督下完成複雜任務的可行性
- 14:28自我進化的根本障礙:「遞迴漂移」與驗證困境
- 17:37元能力與搜尋策略:如何讓 AI 自我診斷並最佳化
- 29:33多智慧體協作:超越單一模型上限的架構設計
- 32:59垂直領域 Agent Teams:從通用模型到專業化協作
- 43:50未知領域的科學發現:如何像科學家一樣提問
- 48:38後訓練中的自我診斷:從 RHF 到 RL 的混合策略
- 52:01避免過度拍馬屁:如何訓練出真實的科學品味
- 56:54頂尖科學家資料的價值:小樣本與大模型對齊
- 1:04:48AlphaFold 與 Gemini 的共創:AI 作為科學合作夥伴的趨勢
提到的工具與公司
- Apodex
- Agentic RL
適合誰看
對AI未來發展、自我進化機制及Heavy Duty Solver理念感興趣的技術愛好者。
摘要依據
- 講者
- 泓君
- 依據
- 語音轉文字
為什麼排在這裡
- 人氣
- 0.41
- 新鮮
- 0.71
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- 想要递归自我改进吗?做梦吧! | 谷歌Dream-RSI | DeepMind | AlphaEvolve | Gemini | AI自我进化 | 发现树 | 行动轨迹影片 ・ Best Partners TV ・ 14 分鐘(在新分頁開啟原站)
- Stanford CS329A Self-Improving AI Agents | Part 3 | Robust Verification影片 ・ Stanford Online ・ 1 小時 13 分(在新分頁開啟原站)
- Andrej Karpathy on Code Agents, AutoResearch, and the Loopy Era of AIPodcast ・ No Priors ・ 1 小時 7 分(在新分頁開啟原站)
- Stanford CS329A Self-Improving AI Agents | Part 7 | Self-Improvement and Deep Research Agents影片 ・ Stanford Online ・ 1 小時 12 分(在新分頁開啟原站)
- AI is Already Building AI | Google DeepMind’s Mostafa DehghaniPodcast ・ The MAD Podcast ・ 1 小時 5 分(在新分頁開啟原站)
- We Let Claude Code and Codex Race Human Researchers — Elie Bakouch, Prime Intellect影片 ・ AI Engineer ・ 20 分鐘(在新分頁開啟原站)
摘要由 AI 根據原文產生,可能有誤;完整內容請看原站。聽節目(在新分頁開啟原站)
