强化学习课程进阶EN4–8 周★ 22k13 章可站内阅读
RL Algorithms Notebooks
经典强化学习算法练习笔记本
Denny Britz· 22,109 stars
经典强化学习算法练习笔记本,覆盖 MDP、动态规划、蒙特卡洛、时序差分、DQN 与策略梯度等内容。适合配合教材反复做算法实现练习,把公式真正落到可运行代码中验证。
为什么收录 · 强化学习算法练习经典仓,和 Spinning Up、Hands-on RL 形成读练闭环。
强化学习OpenAI Gym练习算法
这本书强在哪
- GitHub 高星真学习内容
- 可导入站内阅读
- 材料结构清晰
- 适合系统跟学
建议怎么学
- 01按大纲顺序推进
- 02每章留下自己的实验记录
- 03卡点时回看对应知识库文章
适合谁 / 前置
- Python 基础
- 愿意跟练代码或笔记
学完得到什么
- 掌握该教程主线知识点
- 能复现关键实验或练习
- 建立可对照的学习笔记
- 为下一阶段课程打底
目录
来自站内阅读器镜像;点击章节直接阅读
DP4 章
DQN2 章
FA1 章
MC4 章
TD2 章
策展亮点章节
IntroductionMDPDPMCTDFADQNPolicy Gradient
仓库数据
Stars22,109
Forks6,124
主要语言Jupyter Notebook
创建2016/8/25
更新2026/8/11
2b832284(master)· 许可证 MIT License (MIT)。 上游更新后可通过同步脚本刷新。