#207 · 主分类: 教育与研究

LLM-RL-Visualized

ai algorithm deep-learning llm machine-learning natural-language-processing nlp-machine-learning reinforcement-learning transformers vlm

🌟100+ 原创 LLM / RL 原理图📚,《大模型算法》作者巨献!💥(100+ LLM/RL Algorithm Maps )

项目最后更新:08/29/26

GitHub Stars

4.8K

Forks数量

464

贡献者数量

1

许可证

Other

收录理由

这个仓库收录了上百张原创手绘示意图,把大语言模型和强化学习算法的内部机制一步步拆开来讲,从Transformer结构、注意力机制,到SFT、LoRA、DPO、RLHF、PPO、GRPO,再到CoT、MCTS这类推理方法,全都画成了可无限缩放的SVG矢量图。它不是能跑的代码,而是一套学习素材,适合想搞懂或想讲清这些系统的人——从MDP基础到现代策略梯度训练的脉络,在同一个图集里就能顺下来。开发者接项目前想快速回顾、学生准备面试、或者要给团队解释RLHF的取舍又不想含糊带过,这套图都能派上用场。配套的书籍提供了更详细的文字解读,作者也在持续勘误和扩充内容,所以GRPO、VLM这类较新的方法也会陆续补进来。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目