#199 · 主分类: 教育与研究

reasoning-from-scratch

ai artificial-intelligence chain-of-thought deep-learning distillation grpo inference-time-scaling large-language-models llm llms machine-learning math-reasoning python pytorch reasoning reasoning-models reinforcement-learning rlhf test-time-compute

从零开始用PyTorch逐步实现推理LLM

项目最后更新:08/27/26

GitHub Stars

5.1K

Forks数量

785

贡献者数量

5

许可证

Apache-2.0

收录理由

reasoning-from-scratch 是 Sebastian Raschka 所著《Build a Reasoning Model (From Scratch)》一书的官方代码仓库。它从一个预训练的 Qwen3 基础模型出发,逐章加入推理能力:推理时扩展、自我精炼、基于 GRPO 的强化学习以及蒸馏,这些正是 DeepSeek R1、GPT-5 Thinking 等模型所采用的技术路线。每个技术点都配有 PyTorch 笔记本,消费级硬件即可运行,前几章用一台笔记本就足够。书末的练习和附录覆盖了评估、批处理、聊天界面等内容,学完教程后还能作为随手可查的参考。对于想亲眼看看推理模型到底怎么组装起来的工程师和研究者,这是一个非常具体的起点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目