#622 · 主分类: 教育与研究

repeng

language-model machine-learning representation-engineering sae saes sparse-autoencoder sparse-autoencoders transformers

用于生成RepE控制向量的库

项目最后更新:09/24/25

GitHub Stars

757

Forks数量

67

贡献者数量

5

许可证

MIT

收录理由

repeng 是一个轻量的 Python 库,把表征工程(representation engineering)落到了实处。你只需包装一个 Hugging Face 的 transformer 模型,构造一小段成对语句——这些语句在某个你关心的特质上恰好相反——然后花不到一分钟就能训练出一个控制向量。推理时把这个向量施加到模型上,就能引导生成结果,比如让模型回答得更“迷幻”或更诚实。它的 API 很精简,几个类加一次 train 调用,底层由 torch 和 transformers 承担繁重计算,适合那些想调整模型行为、却不想从零搭建整套机制的人。仓库附带的 notebook 完整演示了从数据集构建到向量导出的整个流程。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目