#103 · 主分类: 基础模型
Orion
Orion-14B是一个多语言基础模型系列,包含基础、对话、长上下文、量化、RAG和智能体调优变体,在中文、英语、日语和韩语方面表现出色。
项目最后更新:06/03/24
GitHub Stars
811
Forks数量
59
贡献者数量
10
许可证
Apache-2.0
收录理由
Orion-14B 是一个从零训练的多语言模型家族,训练语料规模达 2.5T token,覆盖中文、英文、日文和韩文,在日文和韩文的评测集上表现尤为突出。仓库里不止有 14B 基座模型,还附带对话版本、长上下文变体、面向轻量部署的量化版本,以及针对 RAG 和 Agent 场景微调的模型。对于正在评估这些语言的开源权重方案的团队来说,可以拿这一套模型去对比同一组权重在不同服务配置下的表现,省去在不同检查点之间来回切换的麻烦。README 里还给出了 vLLM 和 llama.cpp 的推理示例,能提前判断模型是否适合自己现有的技术栈,再决定要不要投入。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。