Skip to content
所有標籤

#deep-reinforcement-learning

2 篇文章

Berkeley CS285 作業與期末專案:CPU、GPU、H100 成本分界

五份作業從 CPU 友善的 imitation learning 走到 H100 LLM RL 與六小時 offline RL runs;自學者應按成本分三階段,而非整套照搬。

Berkeley CS285 Spring 2026 導讀:25 講、5 份作業與自學邊界

Spring 2026 CS185/285 公開 25 講投影片、9 組討論課資料、5 份作業與 starter code;當期錄影在 bCourses,HW4 預設 H100,不能把它包裝成零成本公開課。