基础理论Cookbook高阶英文按论文选修,长期查阅★ 67k38 章可站内阅读
Annotated Deep Learning Paper Implementations
60+ 论文旁注实现:Transformer 到 RL
labml.ai · 67,299 stars
labml.ai 的论文旁注实现合集:把经典深度学习论文与可运行代码并排讲解,覆盖 Transformer、优化器、GAN、强化学习等。适合已经学过系统课、需要「读论文并能复现」的进阶读者。
为什么收录 · 论文→代码 bridging 质量高、题材广,是 foundations 层架难得的长期查阅型资源。
论文实现Transformer优化器强化学习旁注教程PyTorch
这本书强在哪
- 60+ 实现,论文与代码并排注释,学习体验独特
- 覆盖面从 Transformer 到 RL,适合作为长期工具书
- 实现风格统一,便于横向对比
- 不是入门课,而是进阶读者的「论文健身房」
建议怎么学
- 01每次只选 1 篇与当前工作相关的论文深挖
- 02先读旁注再关注释复述,最后改一处实验
- 03Transformer 相关实现优先,再扩展优化器/RL
- 04入门不足时先回 d2l / 李宏毅,不要硬啃
适合谁 / 前置
- 较扎实的深度学习基础
- 能读英文论文与 PyTorch 代码
- 建议先完成一门系统 DL 课(如 d2l)
学完得到什么
- 能对照旁注读懂经典论文实现
- 按主题收集自己的「论文→代码」卡片
- 加深对 Transformer、优化器、RL 等模块的细节理解
- 具备把论文想法快速落到最小实现的能力
目录
来自站内阅读器镜像;点击章节直接阅读
adaptive computation2 章
capsule networks1 章
conv mixer1 章
diffusion1 章
distillation1 章
gan6 章
graphs2 章
neox1 章
normalization5 章
optimizers1 章
resnet1 章
rl2 章
transformers12 章
- 25An Attention Free Transformermarkdown
- 26Compressive Transformermarkdown
- 27Fast weights transformermarkdown
- 28Feedback Transformermarkdown
- 29FNet: Mixing Tokens with Fourier Transformsmarkdown
- 30Pay Attention to MLPs (gMLP)markdown
- 31Masked Language Model (MLM)markdown
- 32MLP-Mixer: An all-MLP Architecture for Visionmarkdown
- 33Primer: Searching for Efficient Transformers for Language Modelingmarkdown
- 34Switch Transformermarkdown
- 35Vision Transformer (ViT)markdown
- 36Transformer XLmarkdown
uncertainty2 章
策展亮点章节
Transformers 系列优化器与训练技巧GAN / 生成模型强化学习算法其他经典结构
仓库数据
Stars67,299
Forks6,748
主要语言Python
创建2020/8/25
更新2026/1/22
33ab0228(master)· 许可证 MIT License (MIT)。 上游更新后可通过同步脚本刷新。