#71 · 主分类: 基础模型
openchat
large-language-models
open-source
transformers
OpenChat:利用不完美数据推进开源语言模型
项目最后更新:09/13/24
GitHub Stars
5.5K
Forks数量
429
贡献者数量
17
许可证
Apache-2.0
收录理由
OpenChat 是一系列基于 Llama-2 和 Llama-3 微调而来的指令模型,其中 7B 和 8B 版本体积小巧,单张消费级显卡(比如 RTX 3090)就能跑起来。真正值得关注的是它的训练思路:C-RLFT 方法从离线强化学习中获得启发,不需要偏好标注就能处理质量参差不齐的数据。即便你打算自己微调模型而非直接下载权重,这部分内容也很有参考价值。仓库里还附带生成和评测各版本所用的训练与评估脚本,Apache-2.0 协议也让商用变得省心。对硬件预算有限、又想自托管助手的团队来说,它既是可部署的模型,也是一份清晰的构建参考。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。