跳到主要內容
AI 武林
影片進階中文7,630 次觀看

DeepSeek多模态凭什么把GPT 5.4拉开:4000万样本+三层奖励+OPD蒸馏,把"框和点"喂进推理链的完整训练秘方

來源 唐国梁Tommy

看影片(在新分頁開啟原站)連到 Bilibili・唐国梁Tommy

摘要

解析 DeepSeek 如何利用 4000 萬高品質樣本與 OPD 蒸餾技術,將「框」與「點」融入推理鏈。觀眾可掌握從資料過濾、負樣本設計到後訓練流水線的完整多模態訓練工程視角。

DeepSeek reveals its training secrets for multimodal reasoning using 40 million samples and OPD distillation.

這筆內容還沒有取得字幕或內文,這段摘要只根據標題與說明欄產生,可能不夠準確;實際內容請以原站為準。

提到的工具與公司

適合誰看

適合多模態、視覺語言模型及強化學習方向的學習者與從業人員。

摘要依據

依據
標題與說明欄(還沒有取得字幕或內文)

為什麼排在這裡

人氣
0.29
新鮮
0.57

在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算

摘要由 AI 根據標題與說明欄產生(還沒有取得原文),可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)