#79 · 主分类: 基础模型

Skywork

llm

Skywork系列模型在3.2TB高质量多语言(主要是中文和英文)和代码数据上预训练。我们已开源模型、训练数据、评估数据、评估方法等。

项目最后更新:03/07/25

GitHub Stars

1.5K

Forks数量

148

贡献者数量

7

许可证

Other

收录理由

Skywork 是一个中英双语的大模型系列,开源内容不仅包含模型权重,还把训练数据、评测数据以及评测方法一并公开,这让小团队有机会深入研究一个 13B 规模模型从数据到训练再到评测的完整链路,而不是把它当作黑盒来使用。仓库里提供了基座、对话、数学、多模态四个版本,另外还有量化后的检查点,可以适配消费级显卡的部署需求。文档中详细描述了 3.2 万亿 token 的预训练方案和所用基准,照着这些材料,复现并对比其他 13B 模型的难度会低很多。如果你的工作场景以中文为主,或者希望找一个轻量级的本地部署方案,这个项目很值得关注。需要提醒的是,它使用的是自定义社区许可,并非标准的开源许可证,商业使用前务必先仔细阅读条款。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目