影片進階EN826 次觀看
CMU LLM Inference (8): Self-Refine and Self-Correction Methods
看影片(在新分頁開啟原站)連到 YouTube・Graham Neubig
摘要
章節由 Graham Neubig 講授,介紹自我修正與迭代精進方法,涵蓋程式碼自動除錯與代理工具的強化學習。觀眾可學習如何利用自我反饋機制提升大型語言模型的推理與修正能力。
This lecture covers self-refinement methods, including self-debugging for code generation and verbal reinforcement learning for agents.
這筆內容還沒有取得字幕或內文,這段摘要只根據標題與說明欄產生,可能不夠準確;實際內容請以原站為準。
適合誰看
正在學習自然語言處理或大型語言模型架構的研究生與工程師。
摘要依據
- 講者
- Graham Neubig
- 依據
- 標題與說明欄(還沒有取得字幕或內文)
為什麼排在這裡
- 人氣
- 0.11
- 新鮮
- 0.26
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- CMU LLM Inference (7): Chain of Thought and Intermediate Steps影片 ・ Graham Neubig
- Stanford CS329A Self-Improving AI Agents | Part 4 | Learning from Feedback with Tools/Code影片 ・ Stanford Online ・ 1 小時 11 分
- CMU LLM Inference (9): Reasoning Models影片 ・ Graham Neubig
- AI 原生思维——像训练大模型一样训练自己文章 ・ 寶玉
- Stanford CS329A Self-Improving AI Agents | Part 3 | Robust Verification影片 ・ Stanford Online ・ 1 小時 13 分
- Can LLMs Introspect? A Live Paper Review影片 ・ Neel Nanda ・ 2 小時 15 分
摘要由 AI 根據標題與說明欄產生(還沒有取得原文),可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)
