#74 · 主分类: 基础模型
Baichuan2
artificial-intelligence
benchmark
ceval
chatgpt
chinese
gpt
gpt-4
huggingface
large-language-models
llama2
mmlu
natural-language-processing
由百川智能技术开发的一系列大型语言模型
项目最后更新:11/08/24
GitHub Stars
4.1K
Forks数量
294
贡献者数量
10
许可证
Apache-2.0
收录理由
百川智能推出的Baichuan 2系列开源大语言模型,提供7B和13B两种规格,每个规格都有基座版和对话版,对话版还提供4bits量化版本,能有效降低内存占用。对话模型在C-Eval、CMMLU等中文基准测试上表现优异,高考成绩也很有竞争力,适合构建中文应用的团队自托管部署,无需依赖外部API。仓库内置推理指南、微调脚本和中间检查点,从下载模型到上线服务或改造领域变体,无需额外整合工具。许可协议宽松,申请后可免费商用,是评估和试用的低门槛选择。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。