#22 · 主分类: 基础模型

Chinese-LLaMA-Alpaca-2

64k alpaca alpaca-2 alpaca2 flash-attention large-language-models llama llama-2 llama2 llm nlp rlhf yarn

中文LLaMA-2 & Alpaca-2大模型二期项目 + 64K超长上下文模型

项目最后更新:04/19/26

GitHub Stars

7.1K

Forks数量

561

贡献者数量

8

许可证

Apache-2.0

收录理由

这个项目为需要扎实中文能力的模型开发与微调工作提供了很好的出发点,而非仅仅是一个可调用的接口。它在Meta的Llama-2基础上扩充了中文词表,并利用大规模中文语料做了增量预训练,相比原始权重,在中文语义理解和指令跟随上都有肉眼可见的提升。如果日常处理文档或检索任务经常超出标准4K上下文窗口,那16K和64K的长上下文版本值得特别关注。项目还开放了预训练和指令微调脚本,方便在自有数据上继续训练。由于模型保持LLaMA生态兼容,可以轻松接入transformers、llama.cpp、vLLM等常见工具链,本地量化部署也相当省事。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目