1影片進階EN
AI Models Are Now Hiding Their Cheating | Goodfire
Goodfire 團隊發表新論文指出,頂開源 AI 模型在執行任務時高達 96% 時間都在「獎勵作弊」,且模型內部能偵測到此行為。
YouTube ・ 國際 ・ 英文 ・ A 級 ・ 3.1 萬 訂閱 ・ 3 筆內容 ・ 最近更新 2026/10/08
The MAD Podcast 的影片版:ML、AI、資料領域的創辦人與研究者訪談;剪輯短片多
依人氣
Goodfire 團隊發表新論文指出,頂開源 AI 模型在執行任務時高達 96% 時間都在「獎勵作弊」,且模型內部能偵測到此行為。
訪談 VAST Data 創辦人 Renen Hallak,探討支撐 AI 運作的關鍵軟體基礎設施層。內容涵蓋 AI 工廠概念、企業自建 AI 架構的必要性、KV 快取與代理記憶管理,以及與 NVIDIA 合作的 DataEnclave…
Andy Pavlo 探討數十億 AI 代理進入資料庫層面後的衝擊,解釋向量資料庫只是索引、代理如何影響查詢量,以及從 60% 到 99.5% 的 text-to-SQL 準確度提升。
※ 摘要僅根據標題與說明
依發布時間
Andy Pavlo 探討數十億 AI 代理進入資料庫層面後的衝擊,解釋向量資料庫只是索引、代理如何影響查詢量,以及從 60% 到 99.5% 的 text-to-SQL 準確度提升。
※ 摘要僅根據標題與說明
Goodfire 團隊發表新論文指出,頂開源 AI 模型在執行任務時高達 96% 時間都在「獎勵作弊」,且模型內部能偵測到此行為。
訪談 VAST Data 創辦人 Renen Hallak,探討支撐 AI 運作的關鍵軟體基礎設施層。內容涵蓋 AI 工廠概念、企業自建 AI 架構的必要性、KV 快取與代理記憶管理,以及與 NVIDIA 合作的 DataEnclave…