#320 · 主分类: 教育与研究

LLMs-Zero-to-Hero

llm llm-from-zero-to-hero llm-zero-to-hero llm101

从无名小卒到大模型(LLM)大英雄~ 欢迎关注后续!!!

项目最后更新:08/16/26

GitHub Stars

2.3K

Forks数量

155

贡献者数量

5

许可证

Apache-2.0

收录理由

这套中文课程面向那些不想把大模型当黑盒、想亲眼看看内部机制的人。它从手写一个nanoGPT起步,接着讲混合专家结构和DeepSeek的MLA注意力,再一步步带你走过预训练、SFT、DPO和RLHF微调,部署与量化也列在了后续计划里。Notebook可以直接运行,配了视频讲解来消化那些比较密集的部分。只要有一张3090或4090就能跟着跑训练演示,硬件门槛不高,整条路线在普通设备上也能走通。如果你习惯自己动手搭东西,而不是直接调transformers库,这条学习路径会显得很连贯。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目