看影片(在新分頁開啟原站)連到 Fireship
摘要
介紹 PewDiePie 訓練的 Ajax 模型,這是基於 Qwen 3.5 並移除安全限制後,透過 GPT Soul 輸出進行蒸餾訓練而成的。觀眾可學習如何建立自己的無審查 AI 模型,包括使用 GRPO 強化學習與 Heretic 工具去除過濾機制。
The video explains how PewDiePie built the uncensored Ajax model by distilling Qwen 3.5 and removing safety filters using GRPO and Heretic tools.
摘要、重點與章節標題由語言模型整理,細節(誰說的、數字、先後)可能有誤;要引用請以原始內容為準。
重點
- PewDiePie 訓練的 Ajax 模型是基於 Qwen 3.5 並移除安全限制的無審查模型。
- 詳細說明使用 GRPO 與 Heretic 工具建立自訂 AI 模型的具體步驟。
- 內容探討 OpenAI 禁止蒸餾技術的原因及其對大模型開發的影響。
提到的工具與公司
- PewDiePie
- Ajax
- Odysseus
- Qwen 3.5
- GPT Soul
- GRPO
- Heretic
- Namespace
適合誰看
適合對機器學習、模型訓練或 AI 安全機制感興趣的開發者與技術愛好者。
摘要依據
- 依據
- 自動字幕
為什麼排在這裡
- 人氣
- 0.99
- 新鮮
- 0.99
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- Chill week with Qwen 27B and GLM 5.3 beating GPTs, OpenAI announces pausing RL to focus on security and a cancer vaccine being producedPodcast ・ ThursdAI ・ 1 小時 51 分
- not much happened today文章 ・ AINews(Latent Space/smol.ai)
- OpenAI's model just JAILBROKE ITSELF...影片 ・ Wes Roth ・ 24 分鐘
- How DeepSeek leveraged Qwen and Llama to build its model in $5MPodcast ・ The AI Native Dev ・ 40 分鐘
- 同一个模型,装一个插件前后判若两个 AI:DeepSeek 到底开源了什么? | 回到Axton影片 ・ 回到Axton ・ 18 分鐘
- Build Better AI Agents with RL & Fine-Tuning (Kyle from OpenPipe)影片 ・ AI Tinkerers ・ 51 分鐘
摘要由 AI 根據原文產生,可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)
