Webinar: AI Agent Simulation of Human Behavior with Michael Bernstein
教授 Michael Bernstein 探討如何利用大型語言模型模擬人類行為,打造能預測組織與客戶反應的 AI 代理。透過深度訪談建立「數位孿生」,解決傳統模擬模型過於簡化或刻板印象的問題,協助決策者進行更精準的「如果」情境推演。
依發布時間
教授 Michael Bernstein 探討如何利用大型語言模型模擬人類行為,打造能預測組織與客戶反應的 AI 代理。透過深度訪談建立「數位孿生」,解決傳統模擬模型過於簡化或刻板印象的問題,協助決策者進行更精準的「如果」情境推演。
薩姆·奧爾曼坦回應 OpenAI 因模型能力過快提升而暫停前沿訓練,並提出 RSI 進展越快 IPO 應越遲的反常識觀點。內容涵蓋安全對齊調整、Astra 模型突破與算力策略,探討超級智慧時代人類生活與隱私立場。
由 TopK 執行長 Marek Galovič 分享,解釋為何單一向量嵌入在代理搜尋中會丟失細節,並介紹保留每個 token 獨立的「多向量檢索」技術。
※ 摘要僅根據標題與說明
訪談 Recursive Superintelligence 聯創田淵棟,探討 AI 如何透過編碼能力實現自我進化的 RSI 概念。內容涵蓋從 AutoML 到 RSI 的演進、公司首批自動化研究成果,以及對 AI 終將成為科學的展望。
探討從單純聊天機器人轉向具備自主規劃能力的「代理系統」,並比較了 ChatGPT 與 Claude 在不同任務中的優劣。作者建議高風險任務應使用頂級模型並開啟高階思考模式,同時詳細說明如何透過「Cowork/Work」模式或「Code/…
介紹本地 AI 推理引擎與硬體架構,透過實測比較不同軟體與硬體組合的效能。觀眾可學習如何選擇適合的推理工具並最佳化本地部署。
※ 摘要僅根據標題與說明
由 Greg Isenberg 與 Vas 對談,深入解析「AI 前線部署工程師(FDE)」的角色定義與職涯路徑。內容涵蓋從 Palantir 起源的 FDE 職責、如何判斷 AI 應用時機、以及一套具體的三十天實戰計畫,教導讀者如何將通…
分析開放權重模型與封閉模型在網路安全能力上的差距縮小趨勢,並介紹 Kimi K3 模型及其自編譯器能力。同時探討 Demis Hassabis 提出的 AI 標準監管框架,以及 AI 系統執行隱藏惡意任務的風險,最後以科幻故事反思 AI…
Nick Saraev 測試了 Moonshot 公司推出的 Kimi K3 模型,並與 GPT-5 進行對比。影片展示了 Kimi K3 在程式設計、3D 繪圖及創意任務上的表現,指出其價格優勢與開放生態的潛力。
演講者 Rohan Sinha 探討如何建立可信賴的自主機器人系統,針對傳統物理安全檢測無法處理的「語義異常」提出解決方案。
探討 AI 時代 Token 消耗量成為新指標與貨幣戰爭,解析大模型定價機制、OpenRouter 等聚合平台如何獲利,以及中國模型憑藉高價效比出海的趨勢。觀眾可了解 Token 經濟學原理、成本結構與未來商業模式演變。
Alex Lupsasca 在訪談中分享 AI 如何從寫郵件的助手,演變成能解決理論物理難題的超級工具。他描述 GPT-5 等模型如何在短短數小時內重現他花費數年完成的論文,並解決了物理學家困擾已久的問題。
OpenAI 共同創辦人 Greg Brockman 在演講中探討算力匱乏、模型架構演進與 AGI 現況,指出人類注意力正成為新瓶頸。他分享編碼工具如何從輔助變為主導,並建議企業建立完善的資料治理與代理工作流規範。
Joy Jiao 與 Yunyun Wang 探討 OpenAI 如何開發專注於生命科學的模型系列,利用測試時運算擴展加速藥物發現與實驗自動化。內容涵蓋自主實驗室、生物風險管理以及 AI 如何讓專家級知識普及,解決科學研究中的瓶頸。
分析 DeepSeek 近期頻繁宕機現象,並透過其核心論文拼湊出 V4 模型技術路徑。內容涵蓋 mHC 穩定性、NSA 百萬上下文處理等關鍵技術,探討其在 Agent 時代的競爭優勢與價格策略。
※ 摘要僅根據標題與說明
Robert Lange 與 Tim 探討 Shinka Evolve 框架,結合大型語言模型與演化演算法,自動設計程式並解決開端問題。內容涵蓋如何透過島嶼架構與多模型協同提升搜尋效率,以及未來 AI 如何協助人類進行科學發現與驗證。
Podcast 訪談探討 AMP 團隊決定終止側邊欄編輯器擴展,轉向更進階的代理模式與 CLI 工具。講者說明新一代模型(如 GPT-5)已能獨立完成複雜任務,無需即時互動,因此傳統的「助手」式工作流已過時。
回顧 2025 年 AI 領域的奇異進展與 2026 年預測,涵蓋推理模型、Genie 3 可玩世界、AI 垃圾內容主流化及 GPT-5 的誤解。觀眾能了解當前技術邊界、評估指標的缺陷,並掌握「側向生產力」與自動化資訊發現等未來趨勢。
深入解析 OpenAI 最新發布的 GPT 5.2 模型,探討其在專業任務表現、推理成本與不同評測標準下的優勢與劣勢。透過實際測試與多項 benchmark 比較,幫助讀者釐清模型真實能力與市場宣傳之間的差距。
訪談 OpenAI 研究主管與產品經理,探討 GPT-5.1 如何將所有對話模型改為推理模型,並透過模型切換器與個性設定提升情感智商與使用者控制力。
Kevin Weil 與 Alex Lupsasca 探討 GPT-5 如何加速科學發現,從數學證明、物理計算到文獻搜尋。內容包含具體案例與 OpenAI 發表的論文,說明 AI 如何協助科學家突破知識邊界並預測未來趨勢。
作者 Ethan Mollick 基於 OpenAI 的真實使用資料,提供 2025 年底的 AI 工具選型指南,涵蓋免費與付費模型的比較、不同模型(如 GPT-5、Gemini、Claude)的適用場景,以及 Deep Research…
介紹如何評估生成式人工智慧的能力,涵蓋使用 Benchmark 與 Evaluation Metric 的方法、Exact Match 的侷限、以及考量速度、成本與安全性等面向。
訪談深入探討 OpenAI 企業版業務,透過 T-Mobile 語音支援與 Amgen 藥物研發等案例,說明 AI 如何轉化為實際商業價值。
探討如何用生成式 AI 模擬消費者反應,輔助企業制定商業決策。講者分享與佳潔士合作,利用貝式模型與合成消費者進行市場測試的經驗,並討論如何建立可靠的多代理系統與防護機制。
回顧矽谷 AI 市場從追求模型智商轉向比拼 Token 消耗量的新趨勢,探討 Infra 整合與應用落地的關鍵變化。內容涵蓋 GPT-5 發布、Meta 與 Google 的戰略調整,以及輝達估值邏輯的轉變,適合關注 AI 投資與產業動態…
探討 Amp 團隊如何評估與選擇不同大型語言模型用於程式碼代理。內容涵蓋為何工具呼叫能力是關鍵差異,Gemini Pro 在複雜任務中的不足,以及開放模型如 K2 和 Qwen 的潛力。
實測 GPT-5、Opus 4.1 與 GPT-OSS 模型在代理程式碼任務中的表現,透過 Nano Agent MCP 伺服器建立公平評測環境。觀眾能學習如何構建代理架構、平衡效能與成本,並掌握在裝置上執行開源模型的實際方法。
OpenAI 創辦人 Sam Altman 與主持人 Andrew Mayne 探討 AGI 定義、GPT-5 發展、Project Stargate 計畫及未來硬體。
依人氣
Joy Jiao 與 Yunyun Wang 探討 OpenAI 如何開發專注於生命科學的模型系列,利用測試時運算擴展加速藥物發現與實驗自動化。內容涵蓋自主實驗室、生物風險管理以及 AI 如何讓專家級知識普及,解決科學研究中的瓶頸。
Kevin Weil 與 Alex Lupsasca 探討 GPT-5 如何加速科學發現,從數學證明、物理計算到文獻搜尋。內容包含具體案例與 OpenAI 發表的論文,說明 AI 如何協助科學家突破知識邊界並預測未來趨勢。
訪談 OpenAI 研究主管與產品經理,探討 GPT-5.1 如何將所有對話模型改為推理模型,並透過模型切換器與個性設定提升情感智商與使用者控制力。
OpenAI 創辦人 Sam Altman 與主持人 Andrew Mayne 探討 AGI 定義、GPT-5 發展、Project Stargate 計畫及未來硬體。
教授 Michael Bernstein 探討如何利用大型語言模型模擬人類行為,打造能預測組織與客戶反應的 AI 代理。透過深度訪談建立「數位孿生」,解決傳統模擬模型過於簡化或刻板印象的問題,協助決策者進行更精準的「如果」情境推演。
由 Greg Isenberg 與 Vas 對談,深入解析「AI 前線部署工程師(FDE)」的角色定義與職涯路徑。內容涵蓋從 Palantir 起源的 FDE 職責、如何判斷 AI 應用時機、以及一套具體的三十天實戰計畫,教導讀者如何將通…
探討 AI 時代 Token 消耗量成為新指標與貨幣戰爭,解析大模型定價機制、OpenRouter 等聚合平台如何獲利,以及中國模型憑藉高價效比出海的趨勢。觀眾可了解 Token 經濟學原理、成本結構與未來商業模式演變。
Nick Saraev 測試了 Moonshot 公司推出的 Kimi K3 模型,並與 GPT-5 進行對比。影片展示了 Kimi K3 在程式設計、3D 繪圖及創意任務上的表現,指出其價格優勢與開放生態的潛力。
作者 Ethan Mollick 基於 OpenAI 的真實使用資料,提供 2025 年底的 AI 工具選型指南,涵蓋免費與付費模型的比較、不同模型(如 GPT-5、Gemini、Claude)的適用場景,以及 Deep Research…
探討從單純聊天機器人轉向具備自主規劃能力的「代理系統」,並比較了 ChatGPT 與 Claude 在不同任務中的優劣。作者建議高風險任務應使用頂級模型並開啟高階思考模式,同時詳細說明如何透過「Cowork/Work」模式或「Code/…