#71 · 主分类: 基础模型

openchat

large-language-models open-source transformers

OpenChat:利用不完美数据推进开源语言模型

项目最后更新:09/13/24

GitHub Stars

5.5K

Forks数量

429

贡献者数量

17

许可证

Apache-2.0

收录理由

OpenChat 是一系列基于 Llama-2 和 Llama-3 微调而来的指令模型,其中 7B 和 8B 版本体积小巧,单张消费级显卡(比如 RTX 3090)就能跑起来。真正值得关注的是它的训练思路:C-RLFT 方法从离线强化学习中获得启发,不需要偏好标注就能处理质量参差不齐的数据。即便你打算自己微调模型而非直接下载权重,这部分内容也很有参考价值。仓库里还附带生成和评测各版本所用的训练与评估脚本,Apache-2.0 协议也让商用变得省心。对硬件预算有限、又想自托管助手的团队来说,它既是可部署的模型,也是一份清晰的构建参考。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目