#32 · 主分类: 基础模型

InternLM

chatbot chinese fine-tuning-llm flash-attention gpt large-language-model llm long-context pretrained-models rlhf

InternLM系列的官方发布(InternLM、InternLM2、InternLM2.5、InternLM3)

项目最后更新:10/30/25

GitHub Stars

7.3K

Forks数量

509

贡献者数量

63

许可证

Apache-2.0

收录理由

这个仓库是 InternLM 系列模型的官方发布源头,从最初的 7B、20B 版本一路延续到 InternLM2、InternLM2.5 和最新的 InternLM3 代际,每个版本都提供了基础模型和经过指令微调的对话模型,并附有下载链接和模型卡。其中最新推出的 InternLM3-8B-Instruct 在推理和知识密集型任务上的表现不逊于 Llama3.1-8B 和 Qwen2.5-7B,而训练仅用了约 4 万亿 token,相比同规模模型节省了四分之三以上的算力开销,对算力有限的研究团队相当友好。仓库还收录了奖励模型以及支持百万 token 超长上下文的对话变体,做检索增强或长文档处理时能派上大用场。对中英双语场景的开发者也提供了清晰的文档和示例,上手门槛不高。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目