※ 摘要僅根據標題與說明
最受歡迎
依人氣
- 1.1 萬次觀看
- 2影片入門EN
Train an LLM from Scratch with Karpathy's Nanochat(在新分頁開啟原站)
本影片由 Karpathy 演示如何從零開始訓練一個小型語言模型,透過簡單程式碼即可理解基本架構與訓練流程。
※ 摘要僅根據標題與說明
- 3影片入門EN
Top Transcription / ASR Models in 2026(在新分頁開啟原站)
2026 年 Top 10 大轉寫與 ASR 模型,涵蓋主流與新興技術,助您快速掌握文字轉寫核心。
4,600次觀看※ 摘要僅根據標題與說明
- 4影片入門EN
Training Recursive Models - A Frontier in Adaptive Compute(在新分頁開啟原站)
探討如何訓練可迴歸的模型,並展示其作為適應性計算前沿的潛力。
5,900次觀看※ 摘要僅根據標題與說明
- 5影片進階EN
Voice Loop — A Local Voice Agent in ~500 Lines of Python(在新分頁開啟原站)
介紹一個在本地執行的 Python 語音代理,僅用約 500 行程式碼即可實現,無需依賴雲端服務。
3,500次觀看※ 摘要僅根據標題與說明
- 6影片入門EN
3 tips for better voice agent evals(在新分頁開啟原站)
介紹了提升 AI 語音代理評估質量的三個關鍵技巧:使用強勁的呼叫者、使用強勁的評審者,以及採用文字模式測試。看完後讀者將掌握如何更準確地評估 AI 語音代理的表現。
710次觀看※ 摘要僅根據標題與說明
- 7影片入門EN
Whisper Data Preparation and Fine tuning with Unsloth(在新分頁開啟原站)
介紹如何使用 Unsloth 加速 Whisper 模型的資料準備與精細調校,並提供具體實作步驟。
※ 摘要僅根據標題與說明
- 8影片入門EN
Align Audio and Text for Speech Recognition Model Training(在新分頁開啟原站)
介紹如何將音訊與文字訊號結合,以訓練語音辨識模型。
3,400次觀看※ 摘要僅根據標題與說明
- 9影片進階EN
Which Voice AI Models Respond Fastest(在新分頁開啟原站)
影片實時比對五款即時語音模型,包括 Grok Voice 2.0、ElevenLabs 與 Gemini 3.1 Flash Live 等,分析其回應速度與表現。
632次觀看※ 摘要僅根據標題與說明
- 2,200次觀看
※ 摘要僅根據標題與說明
最新內容
依發布時間
- 影片入門EN
3 tips for better voice agent evals(在新分頁開啟原站)
介紹了提升 AI 語音代理評估質量的三個關鍵技巧:使用強勁的呼叫者、使用強勁的評審者,以及採用文字模式測試。看完後讀者將掌握如何更準確地評估 AI 語音代理的表現。
710次觀看※ 摘要僅根據標題與說明
- 影片進階EN
Which Voice AI Models Respond Fastest(在新分頁開啟原站)
影片實時比對五款即時語音模型,包括 Grok Voice 2.0、ElevenLabs 與 Gemini 3.1 Flash Live 等,分析其回應速度與表現。
632次觀看※ 摘要僅根據標題與說明
- 影片入門EN
Whisper Hinglish - SotA Open Weights Model with Code-switching Capabilities(在新分頁開啟原站)
這則影片介紹了 Trelis 開發的 Whisper Hinglish 模型,該模型支援 Hindi-English 混合語言的轉寫,並具備將 Devanagari 與羅馬字混用編碼的功能。
※ 摘要僅根據標題與說明
- 影片進階EN
Voice Loop — A Local Voice Agent in ~500 Lines of Python(在新分頁開啟原站)
介紹一個在本地執行的 Python 語音代理,僅用約 500 行程式碼即可實現,無需依賴雲端服務。
3,500次觀看※ 摘要僅根據標題與說明
- 影片入門EN
Best Medical Transcription (ASR) Models(在新分頁開啟原站)
介紹了 Best Medical Transcription (ASR) 模型,探討其在醫療領域的應用與優勢。
1,100次觀看※ 摘要僅根據標題與說明
- 1.1 萬次觀看
※ 摘要僅根據標題與說明
- 957次觀看
※ 摘要僅根據標題與說明
- 2,200次觀看
※ 摘要僅根據標題與說明
- 影片入門EN
Top Transcription / ASR Models in 2026(在新分頁開啟原站)
2026 年 Top 10 大轉寫與 ASR 模型,涵蓋主流與新興技術,助您快速掌握文字轉寫核心。
4,600次觀看※ 摘要僅根據標題與說明
- 2,300次觀看
※ 摘要僅根據標題與說明
- 影片入門EN
Transcription Models Zero to Hero - Data Prep, Train + Serve(在新分頁開啟原站)
介紹如何從零開始掌握轉錄模型,涵蓋資料準備、訓練與部署全流程,讓讀者掌握核心技術。
1,700次觀看※ 摘要僅根據標題與說明
- 3,400次觀看
※ 摘要僅根據標題與說明
- 影片入門EN
Training Recursive Models - A Frontier in Adaptive Compute(在新分頁開啟原站)
探討如何訓練可迴歸的模型,並展示其作為適應性計算前沿的潛力。
5,900次觀看※ 摘要僅根據標題與說明
- 影片入門EN
Jean-François Puget et les Navy Seals de Nvidia(在新分頁開啟原站)
介紹了 Nvidia 的 Navy Seals 團隊,並探討他們如何運用 AI 技術來最佳化遊戲效能。
321次觀看※ 摘要僅根據標題與說明
- 影片入門EN
Train an LLM from Scratch with Karpathy's Nanochat(在新分頁開啟原站)
本影片由 Karpathy 演示如何從零開始訓練一個小型語言模型,透過簡單程式碼即可理解基本架構與訓練流程。
※ 摘要僅根據標題與說明
- 影片入門EN
Whisper Data Preparation and Fine tuning with Unsloth(在新分頁開啟原站)
介紹如何使用 Unsloth 加速 Whisper 模型的資料準備與精細調校,並提供具體實作步驟。
※ 摘要僅根據標題與說明
- 821次觀看
※ 摘要僅根據標題與說明
- 影片入門EN
ARC AGI Chat | Unsloth OSS Update | Kyutai STT Update(在新分頁開啟原站)
介紹 ARC AGI Chat 的更新功能,並同步說明 Unsloth 與 Kyutai STT 的最新軟體版本。
458次觀看※ 摘要僅根據標題與說明

















