We're giving 100,000 academic researchers free access to our frontier models(在新分頁開啟原站)
OpenAI 宣佈將免費開放 10 萬名學者的前沿模型,讓學術界能更輕鬆地接觸最新技術。
※ 摘要僅根據標題與說明
Research Frontier ・ 71 筆內容
新架構、推理模型、世界模型等還在發展中的研究方向。
也叫做:研究前沿、world model、world models、世界模型、reasoning model、推理模型、scaling laws、新架構、continual learning
由淺入深:入門 → 進階 → 高階
Which AI Models Are Worth Using(在新分頁開啟原站)
Theo - t3․gg37 分鐘○ 無原文
Frontier post-training recipe review with Finbarr Timbers(在新分頁開啟原站)
Interconnects57 分鐘○ 無原文
EP336. 前沿模型該減速嗎、Anthropic 威脅報告、為什麼要一直聊模型 | M觀點(在新分頁開啟原站)
M觀點1 小時 10 分○ 無原文
Why Tejal Patwardhan stopped underestimating the models - Episode 21
OpenAI Podcast44 分鐘● 有原文
Hugging Face Journal Club: Training AI Scientists to Replicate Research(在新分頁開啟原站)
Hugging Face35 分鐘○ 無原文
World Models and the Future of Spatial AI with Justin Johnson - #775(在新分頁開啟原站)
The TWIML AI Podcast1 小時 6 分○ 無原文
Ep 87: Gemini Co-Lead on World Models, RL's Next Domains & Continual Learning(在新分頁開啟原站)
Unsupervised Learning1 小時○ 無原文
Owning the AI Pareto Frontier — Jeff Dean(在新分頁開啟原站)
Latent Space1 小時 24 分○ 無原文
依相關、人氣、新鮮度綜合排序;站長推薦的加成
OpenAI 宣佈將免費開放 10 萬名學者的前沿模型,讓學術界能更輕鬆地接觸最新技術。
※ 摘要僅根據標題與說明
Tejal Patwardhan 探討舊版評估基準已過時,並強調必須建立前沿評估體系以預測模型能力。她與主持人討論了如何衡量模型進步、避免被遊戲化,以及評估對研究的重要性。
※ 摘要僅根據標題與說明
探討前沿 AI 模型是否該減速發展,並分析 Anthropic 的威脅報告,同時闡述為何持續關注 AI 演進。
※ 摘要僅根據標題與說明
Hugging Face 團隊介紹了 Faraday-27B 模型,該模型經過後訓練以發展科學推理能力,旨在複製 AI 論文。這是通往 AI 研發自動化的一項關鍵步驟。
※ 摘要僅根據標題與說明
這是一場長達 7 小時的訪談,訪談物件包括 Saining Xie、Yann LeCun 與 Fei-Fei Li,探討世界模型與 AMI Labs 等 AI 領域。
※ 摘要僅根據標題與說明
依發布時間
探討 AI 如何透過區域性推理最佳化模型,並指出最接近的模型將改變此過程。
※ 摘要僅根據標題與說明
從 AMD 以 82 億美元全股票收購李飛飛創立的 World Labs 這一交易切入,分析市場對其估值溢價(7 個月從 50 億跳至 82 億)的質疑。
介紹推理時延的擴充套件技術,涵蓋使用平均對數分數解決投票平局問題,並深入探討自修正機制。讀者將掌握如何計算 Token 機率、最佳化數值穩定性,並實作自修正迴圈來提升模型表現。
※ 摘要僅根據標題與說明
Runway 推出 GWM Worlds 2,引入 WorldPrompt 格式,允許使用者即時指定世界狀態並生成時間序列事件。
探討 AI 模型為何需要因果關係而非僅是漂亮的畫素,強調因果理解對提升模型真實性的關鍵作用。
※ 摘要僅根據標題與說明
探討 Opus 5.5 模型,分析其快速出現與 Recursive Self Improvement(自動 AI 研究)的緊密關係。作者指出實驗室對承諾的記錄混亂,並說明追蹤 AI 發展現狀變得極其困難。
※ 摘要僅根據標題與說明
介紹了安德魯·戴與埃洛裡安討論的兩個仍像幼兒般思考的 AI 模型,並分析其優點與缺點。
※ 摘要僅根據標題與說明
※ 摘要僅根據標題與說明
介紹了 Weight Folding 與 CUDA Streams 技術,並揭露了一個導致模型反向運算的 Bug。
※ 摘要僅根據標題與說明
深入探討推理時擴充套件技術,涵蓋溫度調控、Top-p 過濾及多項式取樣以生成多樣化回答,並透過自一致性方法提升大語言模型回答的準確性。
※ 摘要僅根據標題與說明
Fireship 報導指出,Anthropic 的研究人員已決定離職,並揭露其公司對 Claude 模型的不當使用行為。
※ 摘要僅根據標題與說明