影片高階EN4.4 萬 次觀看
Code a Reinforcement Learning Library in C from Scratch (Full Course)
看影片(在新分頁開啟原站)連到 freeCodeCamp.org
摘要
從零開始用 C 語言編寫完整的強化學習框架,包含自訂計算圖與自動微分引擎。學員將建立 Snake 遊戲環境並實現 REINFORCE 演算法,掌握從底層實現到訓練管道的完整流程。
Build a reinforcement learning library from scratch in C, including an autograd engine and a Snake game environment.
摘要、重點與章節標題由語言模型整理,細節(誰說的、數字、先後)可能有誤;要引用請以原始內容為準。
重點
- 從零開始用 C 語言編寫強化學習框架與自動微分引擎。
- 建立自訂 Snake 遊戲環境並實現 REINFORCE 演算法。
- 掌握計算圖、前向反向傳播及訓練管道的實作細節。
章節
依話題轉折切分,標題由 AI 產生
- 00:00Introduction & Overview
- 02:48Setting Up the Autograd Engine & Variables
- 16:09Matrix Creation & Allocation Logic
- 26:27Building Nodes & Computational Graph Traversal
- 56:12Forward & Backward Activation Operations
- 1:04:40Matrix Multiplication (Row-Major & Transpose Operations)
- 1:23:49Building the Snake Game RL Environment
- 1:37:16State Vector Encoding & Reward System
- 1:44:10Training Pipeline & Rollout Buffers Setup
- 1:59:22Implementing the Actor-Critic Model
- 2:07:39Computing Returns, Advantages & Backward Pass
- 2:14:41Optimizer Step, Evaluation & Conclusion
適合誰看
具備 C 語言基礎且想深入理解機器學習原理的開發者。
摘要依據
- 依據
- 自動字幕
為什麼排在這裡
- 人氣
- 0.81
- 新鮮
- 0.84
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- Curriculum for Reinforcement Learning文章 ・ Lilian Weng(部落格)
- Training Agents 3: Reinforcement Learning影片 ・ Hugging Face ・ 1 小時 17 分(在新分頁開啟原站)
- Building the GitHub for RL Environments: Prime Intellect's Will Brown & Johannes HagemannPodcast ・ Training Data ・ 45 分鐘
- Implementing Deep Reinforcement Learning Models with Tensorflow + OpenAI Gym文章 ・ Lilian Weng(部落格)
- Training Agents 4: From reward functions to environments.影片 ・ Hugging Face ・ 1 小時 14 分(在新分頁開啟原站)
- 我随时可以按下重置按钮 | Tibo Sottiaux | Codex | ChatGPT | AI代理 | 强化学习 | 递归自我提升 | 算力瓶颈 | UltraFast | AGI影片 ・ Best Partners TV ・ 14 分鐘(在新分頁開啟原站)
摘要由 AI 根據原文產生,可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)
