#84 · 主分类: 基础模型

DeepSeek-LLM

DeepSeek LLM:让答案存在

项目最后更新:02/04/24

GitHub Stars

7.3K

Forks数量

1.3K

贡献者数量

10

许可证

MIT

收录理由

DeepSeek-LLM 是 DeepSeek 从零训练的双语大模型,开放了 7B 和 67B 的 Base 与 Chat 版本权重,训练数据覆盖中英文各 2 万亿 token。README 里直接给出了模型下载地址和快速上手指引,不用绕路去找。对于想自己部署、微调而不是依赖闭源 API 的团队,这个仓库还附带了每个检查点在 MMLU、GSM8K、HumanEval 以及中文基准上的评测表格,动手拉取几个 GB 的权重之前,就能先看清各尺寸模型的实际表现。配套论文和开源权重让它在需要宽松许可模型、又希望有真实数据支撑选型时,成为一个很靠谱的起点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目