#6 · 主分类: 教育与研究
LLMs-from-scratch
从零开始,逐步用PyTorch实现类似ChatGPT的LLM
项目最后更新:08/29/26
GitHub Stars
104.0K
Forks数量
15.9K
贡献者数量
70
许可证
Other
收录理由
这份代码仓库与 Sebastian Raschka 的同名书籍配套,读起来更像一门循序渐进的课程,而不是拿来即用的工具。每一章都围绕一个具体环节展开:从文本分词、编写注意力机制,到实现 GPT 风格的模型,再在无标注数据上预训练,最后针对分类和指令跟随做微调,全程配有可运行的 notebook 和整理好的脚本。这种逐步推进的方式,对想在接触框架之前先看清 Transformer 内部原理的开发者特别有价值,书中的习题解答也让它很适合自学或课堂教学。仓库还演示了如何加载更大的预训练模型权重,并用 LoRA 做参数高效微调,让你能从玩具规模的训练过渡到真实检查点。无论你是要授课、带新人入门 LLM 内部机制,还是单纯想理解 ChatGPT 背后的原理,这份资料都值得从头到尾过一遍。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
prompts.chat
前身为 Awesome ChatGPT Prompts。分享、发现和收集社区提示词。免费且开源——可自托管,为您的组织提供完全隐私。
JavaGuide
Java 面试 & 后端通用面试指南,覆盖计算机基础、数据库、分布式、高并发、系统设计与 AI 应用开发
system-prompts-and-models-of-ai-tools
精选流行AI助手和编码代理的系统提示、内部工具和AI模型集合。
30-seconds-of-code
编程文章,助你提升开发技能
generative-ai-for-beginners
21节课,开始使用生成式AI构建