#96 · 主分类: 基础模型

open_llama

OpenLLaMA,一个基于RedPajama数据集训练、采用宽松许可的Meta AI LLaMA 7B开源复现。

项目最后更新:07/16/23

GitHub Stars

7.5K

Forks数量

404

贡献者数量

3

许可证

Apache-2.0

收录理由

OpenLLaMA 是 Meta 旗下 LLaMA 模型的一个宽松许可开源复现版本,训练数据来自公开的 RedPajama 语料库以及后续混合数据集。项目提供了 3B、7B 和 13B 三种规模的检查点,这些模型均在约一万亿 token 上完成训练,权重同时涵盖 PyTorch 和 JAX 两种格式。由于权重设计为可直接替换原有 LLaMA 实现,开发团队可以在不依赖 Meta 原始许可条款的前提下进行微调或部署推理。仓库中还附带了 Hugging Face transformers 和 EasyLM 的检查点,以及与原始 LLaMA 模型对比的评估结果,方便使用者自行判断质量差异。如果你需要一个可以继续训练或定制的基础模型,而不是开箱即用的完整应用,这个项目值得关注。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目