聽節目(在新分頁開啟原站)連到 The MAD Podcast
摘要
探討如何建構長時程 AI 代理,由 Basis 共同創辦人 Mitch Troyanovsky 與 Matt Turck 主持。Mitch 分享了他從 ReAct 到 RLVR 的演進,以及為何 2023 年 AI 代理領域放棄過程監督的經驗。他提出 Basis 的新方法:不給出結果,而是監督整個過程,並透過 Braintrust 建立無地面真值行為規範。
Mitch Troyanovsky and Matt Turck discuss how to build long-horizon AI agents. Mitch shares his journey from ReAct to RLVR, and why the industry abandoned process supervision in 2023. He introduces Basis's new approach: not giving outcomes, but supervising the entire process, using Braintrust to set…
重點
- Mitch Troyanovsky 與 Matt Turck 討論如何建構長時程 AI 代理。
- Basis 公司不給結果,而是監督整個過程以確保可靠性。
- 新行為規範 Braintrust 允許無地面真值的自主行為定義。
章節
依話題轉折切分,標題由 AI 產生
- 00:00從非確定性系統到智慧體設計
- 03:41會計工作:AI 長程執行的難題
- 06:02定義長程智慧體:從天氣查詢到功能實現
- 08:24自主智慧體:端到端稅務申報的例項
- 11:17智慧體歷史:從 2022 年 React 框架到 RLVR
- 29:18資料稀缺與合成資料的挑戰
- 36:37行為規範(Behavior Specs)的定義與起源
- 42:282026 年智慧體建構:從提示詞到訓練資料
- 47:22行為規範的維護成本與優先順序
- 54:34系統思維:從資料驅動到ontology
- 1:06:33開源專案 Brand Trust 的起源與合作
- 1:08:56人才需求:語言架構師與智慧體管理師
- 1:11:10系統工程師背景與智慧體部署
- 1:14:34部署智慧體團隊的定義與演進
提到的工具與公司
- Basis
- Braintrust
- RLVR
- ReAct
- AutoGPT
- OpenAI
- Cursor
適合誰看
AI 工程師、系統設計者、希望建構可靠自主代理的開發者。
摘要依據
- 講者
- Mitch Troyanovsky、Matt Turck
- 依據
- 語音轉文字
為什麼排在這裡
- 人氣
- 0.50
- 新鮮
- 0.80
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- Behavior specs for long-trajectory agents影片 ・ Braintrust ・ 3 分鐘(在新分頁開啟原站)
- Ankit Goyal - Infrastructure for Long Running Agents影片 ・ Berkeley RDI ・ 6 分鐘(在新分頁開啟原站)
- Online workshop: Evals foundations影片 ・ Braintrust ・ 42 分鐘(在新分頁開啟原站)
- Harness Engineering for Reliable, Governed AI AgentsPodcast ・ AI Engineering Podcast ・ 1 小時 4 分
- Long-running Agents文章 ・ Addy Osmani(部落格)
- Building the Foundation for the Agentic AI EraPodcast ・ Practical AI ・ 45 分鐘
摘要由 AI 根據原文產生,可能有誤;完整內容請看原站。聽節目(在新分頁開啟原站)
