#184 · 主分类: 深度学习框架

Alpaca-CoT

alpaca chatglm chatgpt cot instruction-tuning llama llm lora moss p-tuning parameter-efficient pytorch tabul tabular-data tabular-model

Alpaca-CoT是一个指令微调平台,提供统一的指令数据接口,支持多种LLM以及LoRA、P-Tuning等参数高效方法。

项目最后更新:12/12/23

GitHub Stars

2.8K

Forks数量

247

贡献者数量

31

许可证

Apache-2.0

收录理由

如果你正在微调大语言模型,想尝试不同的基座模型,或者对比 LoRA、p-tuning 这类参数高效方法的实际效果,又不想每次都在不同工具链之间来回拼装,这个项目提供了一个统一的操作入口。它把指令跟随、思维链等数据集和训练代码打包在一起,方便你复现论文里报告的指令微调结果,也能直接拿同一份提示数据去对比不同模型的响应差异。需要注意的是,它更偏向研究场景下的便利性,而不是开箱即用的成熟产品,所以拿到手后往往需要按自己的环境调整代码,实际的数据集和模型权重则要从配套的 Hugging Face 仓库另行获取。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目