GitHub Stars
558
Forks数量
69
贡献者数量
2
许可证
Apache-2.0
收录理由
对于从事葡萄牙语自然语言处理的人来说,这个仓库是一份坦诚而实用的参考案例,展示了一个小团队如何将通用指令模型适配到单一语言。项目完整记录了Cabrita——一个葡萄牙语指令微调版LLaMA-7B——的构建流程:把Stanford Alpaca数据集翻译成葡萄牙语,用LoRA/PEFT在单张A100上训练约一小时,并检验输出效果。附带的notebook可以让你复现训练过程,也能直接试用发布的LoRA适配器,如果你正打算用有限预算为其他语言或领域做类似的微调,这些资源会很有帮助。作者对取舍直言不讳,比如训练数据依赖机器翻译、模型仅限研究用途,这让你能切实感受到有限算力能做到什么程度,而不是看到一个包装精美的演示。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。