跳到主要內容
AI 武林

Maxime Labonne

部落格 ・ 國際 ・ 英文 ・ A 級 ・ 10 筆內容 ・ 最近更新 2026/09/16

開源模型的蒸餾、微調、量化與評測的技術分析;一兩個月一篇

最受歡迎

依人氣

  1. 6文章高階EN

    The State of the Open Frontier

    分析 2026 年開放權重大型語言模型的現狀,指出 MiMo-V2.6-Pro 等中國模型已接近閉源模型水準,但美國模型仍較弱。文章詳述了 MoE 架構、注意力機制、訓練策略及經濟模式,並比較各模型在指標與實際任務上的表現。

  2. 9文章高階EN

    ChessLFM: 2000 Elo in 230M params

    介紹如何用極小的 2.3 億參數模型,透過特定詞彙化、Stockfish 知識蒸餾與測試時搜尋,達到 2004 棋力等級。讀者可學習將通用語言模型轉化為專注棋盤的引擎,並掌握 SFT、HL-Gauss 與 GRPO 等訓練技巧。

  3. 10文章高階EN

    GLM-5: China's First Public AI Company Ships a Frontier Model

    GLM-5 是智譜 AI 推出的 744B 參數專家混合模型,採用稀疏注意力與深度推理模式,在程式碼與代理任務上表現突出。文章詳細解析其技術架構、訓練流程及 benchmarks,並探討其作為 API 模型的市場定位與挑戰。

最新內容

依發布時間

  1. 文章高階EN

    ChessLFM: 2000 Elo in 230M params

    介紹如何用極小的 2.3 億參數模型,透過特定詞彙化、Stockfish 知識蒸餾與測試時搜尋,達到 2004 棋力等級。讀者可學習將通用語言模型轉化為專注棋盤的引擎,並掌握 SFT、HL-Gauss 與 GRPO 等訓練技巧。

  2. 文章高階EN

    The State of the Open Frontier

    分析 2026 年開放權重大型語言模型的現狀,指出 MiMo-V2.6-Pro 等中國模型已接近閉源模型水準,但美國模型仍較弱。文章詳述了 MoE 架構、注意力機制、訓練策略及經濟模式,並比較各模型在指標與實際任務上的表現。

  3. 文章高階EN

    GLM-5: China's First Public AI Company Ships a Frontier Model

    GLM-5 是智譜 AI 推出的 744B 參數專家混合模型,採用稀疏注意力與深度推理模式,在程式碼與代理任務上表現突出。文章詳細解析其技術架構、訓練流程及 benchmarks,並探討其作為 API 模型的市場定位與挑戰。