#317 · 主分类: 教育与研究
llms-from-scratch-cn
仅需Python基础,从0构建大语言模型;从0逐步构建GLM4\Llama3\RWKV6, 深入理解大模型原理
项目最后更新:03/26/26
GitHub Stars
4.3K
Forks数量
596
贡献者数量
27
许可证
Other
收录理由
如果你平时只是通过API调用大模型,心里却一直好奇它内部到底怎么运作,这本中文教程是个不错的起点。它默认你只有基本的Python功底和一点点PyTorch基础,然后带着你从tokenization、预训练一路走到微调,每一步都有能直接运行的Jupyter notebook。除了GPT风格的主线,还额外逐步实现了GLM4、Llama3和RWKV6,让读者能看到这些模型在代码层面的真实结构。工程师翻一翻notebook,能更清楚地理解自己日常使用的模型底层在做什么;教师也可以直接把内容拿去做课件,毕竟大多数教程一上来就讲微调和部署,反而把最关键的架构实现跳过了。这是一个学习资料,不是拿来部署的工具,适合在真正动手写一个从零开始的项目之前,先静下心来读一遍。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
prompts.chat
前身为 Awesome ChatGPT Prompts。分享、发现和收集社区提示词。免费且开源——可自托管,为您的组织提供完全隐私。
JavaGuide
Java 面试 & 后端通用面试指南,覆盖计算机基础、数据库、分布式、高并发、系统设计与 AI 应用开发
system-prompts-and-models-of-ai-tools
精选流行AI助手和编码代理的系统提示、内部工具和AI模型集合。
30-seconds-of-code
编程文章,助你提升开发技能
generative-ai-for-beginners
21节课,开始使用生成式AI构建