看影片(在新分頁開啟原站)連到 Welch Labs
摘要
探討機器學習模型中難以解釋的「暗物質」現象,介紹機械可解釋性領域的基礎概念與最新研究。觀眾能了解如何分析大型語言模型內部運作,並掌握相關工具進行實驗。
This video explains the 'dark matter' of AI models and introduces the field of mechanistic interpretability.
這筆內容還沒有取得字幕或內文,這段摘要只根據標題與說明欄產生,可能不夠準確;實際內容請以原站為準。
提到的工具與公司
- Gemma
- SAEs
- NeuronPedia
- Manim
- Colab
適合誰看
對機器學習原理有興趣、希望深入理解模型內部結構的開發者或研究者。
摘要依據
- 依據
- 標題與說明欄(還沒有取得字幕或內文)
為什麼排在這裡
- 人氣
- 0.69
- 新鮮
- 0.08
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- Interpretability: Understanding how AI models think影片 ・ Anthropic ・ 59 分鐘
- Don't Go Quiet On Me (by Opus 5.5)影片 ・ Neel Nanda
- 【生成式AI導論 2024】第11講:大型語言模型在「想」什麼呢? — 淺談大型語言模型的可解釋性影片 ・ Hung-yi Lee ・ 45 分鐘
- The most complex model we actually understand影片 ・ Welch Labs ・ 35 分鐘
- ML Interpretability: feature visualization, adversarial example, interp. for language models影片 ・ Umar Jamil ・ 1 小時
- How Reasoning Models Break Mechanistic Interpretability Techniques影片 ・ Neel Nanda ・ 42 分鐘
摘要由 AI 根據標題與說明欄產生(還沒有取得原文),可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)
