#65 · 主分类: 基础模型
Chinese-Vicuna
Chinese-Vicuna:一个基于LLaMA的中文指令跟随模型 —— 一个中文低资源的llama+lora方案,结构参考alpaca
项目最后更新:04/18/25
GitHub Stars
4.1K
Forks数量
405
贡献者数量
7
许可证
Apache-2.0
收录理由
如果你打算做一个中文指令跟随助手,又不想去租集群,Chinese-Vicuna 提供了一条相当务实的路线。它不是一个封闭的黑盒,而是把 LoRA 微调的完整流程直接交到你手里:在单张 RTX-2080Ti 上就能调 LLaMA-7B,3090 上则能跑 13B 版本,这些配置意味着普通桌面显卡也能进行真实实验。除了训练脚本,还带生成和多轮对话代码、一个纯 C++ 的 CPU 推理运行时、4/8 位量化,以及针对中文医学和司法语料重新微调的现成示例。对于想用自己的数据微调中文模型、而不是按 API 调用付费的小团队来说,这是一份具体且低资源消耗的方案。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。