看影片(在新分頁開啟原站)連到 Bilibili・唐国梁Tommy
摘要
解析 DeepSeek 如何利用 4000 萬高品質樣本與 OPD 蒸餾技術,將「框」與「點」融入推理鏈。觀眾可掌握從資料過濾、負樣本設計到後訓練流水線的完整多模態訓練工程視角。
DeepSeek reveals its training secrets for multimodal reasoning using 40 million samples and OPD distillation.
這筆內容還沒有取得字幕或內文,這段摘要只根據標題與說明欄產生,可能不夠準確;實際內容請以原站為準。
提到的工具與公司
- DeepSeek
- OPD
- Poin
適合誰看
適合多模態、視覺語言模型及強化學習方向的學習者與從業人員。
摘要依據
- 依據
- 標題與說明欄(還沒有取得字幕或內文)
為什麼排在這裡
- 人氣
- 0.29
- 新鮮
- 0.57
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- GRPO - Group Relative Policy Optimization - How DeepSeek trains reasoning models影片 ・ Luis Serrano Academy ・ 22 分鐘
- DeepSeek V4是怎么训练出来的?73页PPT深入解析影片 ・ Alchain花生 ・ 36 分鐘
- DeepSeek V4: ten teachers, one student文章 ・ Maxime Labonne
- How DeepSeek leveraged Qwen and Llama to build its model in $5MPodcast ・ The AI Native Dev ・ 40 分鐘
- #258 - Opus 5.5, Sol and Luna, Muse, DeepSeek-V4.1-Flash, XiPodcast ・ Last Week in AI ・ 1 小時 43 分
- 【闪客】深入解读 DeepSeek V1~V4!男女老少都听得懂~影片 ・ 飞天闪客 ・ 12 分鐘
摘要由 AI 根據標題與說明欄產生(還沒有取得原文),可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)
