#133 · 主分类: 基础模型

cabrita

使用葡萄牙语数据微调InstructLLaMA

项目最后更新:06/06/23

GitHub Stars

558

Forks数量

69

贡献者数量

2

许可证

Apache-2.0

收录理由

对于从事葡萄牙语自然语言处理的人来说,这个仓库是一份坦诚而实用的参考案例,展示了一个小团队如何将通用指令模型适配到单一语言。项目完整记录了Cabrita——一个葡萄牙语指令微调版LLaMA-7B——的构建流程:把Stanford Alpaca数据集翻译成葡萄牙语,用LoRA/PEFT在单张A100上训练约一小时,并检验输出效果。附带的notebook可以让你复现训练过程,也能直接试用发布的LoRA适配器,如果你正打算用有限预算为其他语言或领域做类似的微调,这些资源会很有帮助。作者对取舍直言不讳,比如训练数据依赖机器翻译、模型仅限研究用途,这让你能切实感受到有限算力能做到什么程度,而不是看到一个包装精美的演示。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目