GitHub Stars
7.3K
Forks数量
1.3K
贡献者数量
10
许可证
MIT
收录理由
DeepSeek-LLM 是 DeepSeek 从零训练的双语大模型,开放了 7B 和 67B 的 Base 与 Chat 版本权重,训练数据覆盖中英文各 2 万亿 token。README 里直接给出了模型下载地址和快速上手指引,不用绕路去找。对于想自己部署、微调而不是依赖闭源 API 的团队,这个仓库还附带了每个检查点在 MMLU、GSM8K、HumanEval 以及中文基准上的评测表格,动手拉取几个 GB 的权重之前,就能先看清各尺寸模型的实际表现。配套论文和开源权重让它在需要宽松许可模型、又希望有真实数据支撑选型时,成为一个很靠谱的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。