#207 · 主分类: 教育与研究
LLM-RL-Visualized
🌟100+ 原创 LLM / RL 原理图📚,《大模型算法》作者巨献!💥(100+ LLM/RL Algorithm Maps )
项目最后更新:08/29/26
GitHub Stars
4.8K
Forks数量
464
贡献者数量
1
许可证
Other
收录理由
这个仓库收录了上百张原创手绘示意图,把大语言模型和强化学习算法的内部机制一步步拆开来讲,从Transformer结构、注意力机制,到SFT、LoRA、DPO、RLHF、PPO、GRPO,再到CoT、MCTS这类推理方法,全都画成了可无限缩放的SVG矢量图。它不是能跑的代码,而是一套学习素材,适合想搞懂或想讲清这些系统的人——从MDP基础到现代策略梯度训练的脉络,在同一个图集里就能顺下来。开发者接项目前想快速回顾、学生准备面试、或者要给团队解释RLHF的取舍又不想含糊带过,这套图都能派上用场。配套的书籍提供了更详细的文字解读,作者也在持续勘误和扩充内容,所以GRPO、VLM这类较新的方法也会陆续补进来。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
prompts.chat
前身为 Awesome ChatGPT Prompts。分享、发现和收集社区提示词。免费且开源——可自托管,为您的组织提供完全隐私。
JavaGuide
Java 面试 & 后端通用面试指南,覆盖计算机基础、数据库、分布式、高并发、系统设计与 AI 应用开发
system-prompts-and-models-of-ai-tools
精选流行AI助手和编码代理的系统提示、内部工具和AI模型集合。
30-seconds-of-code
编程文章,助你提升开发技能
generative-ai-for-beginners
21节课,开始使用生成式AI构建