#106 · 主分类: 基础模型
Baichuan-13B
artificial-intelligence
benchmark
ceval
chatgpt
chinese
gpt-4
huggingface
large-language-models
mmlu
natural-language-processing
由百川智能技术开发的13B大语言模型
项目最后更新:09/06/23
GitHub Stars
2.9K
Forks数量
229
贡献者数量
6
许可证
Apache-2.0
收录理由
百川智能推出的Baichuan-13B是一个拥有130亿参数的中英双语模型,同时提供基座版本和对齐版本。基座模型适合想要自行微调行为的团队,而对齐版本只需几行代码就能作为对话模型直接使用,开箱即用。它在中文任务上表现尤为突出,并且官方提供了int8和int4量化版本,让模型可以跑在Nvidia 3090这类消费级显卡上,不必依赖服务器集群,对资源有限的小团队来说相当友好。项目文档把推理和微调流程写得很清楚,上手路径明确。商用方面,通过邮件申请获得官方许可后即可免费使用,不需要绑定托管的API服务。如果你的业务场景以中文为主,又希望把模型部署在自己的基础设施里,Baichuan-13B是一个很实在的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。