#140 · 主分类: 深度学习框架
pyreft
interpretability
reft
representation-finetuning
斯坦福NLP的Python库,用于表示微调(ReFT)
项目最后更新:03/05/26
GitHub Stars
1.6K
Forks数量
134
贡献者数量
11
许可证
Apache-2.0
收录理由
pyreft 出自斯坦福 NLP 团队,实现的是表征微调(ReFT)这一思路。相比 LoRA 或 adapter 这类在每个层、每个时间步都追加可训练权重的做法,ReFT 只挑选若干位置,对模型内部的隐藏表征施加轻量干预,因此训练时的显存和算力开销更小。它可以直接配合 HuggingFace 上已有的预训练模型使用,也提供了训练入口、超参数配置文件,还能把结果一键推回 Hub,基本能嵌入常见的微调流程。如果你一直在纠结 LoRA 的秩怎么选,或者想试试用表征干预能不能用更少的可训练参数换来相近的效果,这个库值得在 notebook 里跑一跑看看。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。