#177 · 主分类: 推理与本地部署
ctransformers
使用GGML库以C/C++实现的Transformer模型的Python绑定。
项目最后更新:01/28/24
GitHub Stars
1.9K
Forks数量
143
贡献者数量
6
许可证
MIT
收录理由
如果你厌倦了为每种模型架构分别准备转换流程,ctransformers 提供了一个统一的 AutoModelForCausalLM 风格接口,可以直接从本地磁盘或 Hugging Face Hub 加载 GGML/GGUF 文件。它通过 GGML 以纯 C/C++ 运行 LLaMA、Falcon、MPT、StarCoder、GPT-2 等模型,在笔记本上做轻量推理时无需引入完整的 PyTorch 运行时。流式输出、CUDA/ROCm/Metal 卸载以及 LangChain 集成在模型支持的情况下都是现成的。实验性的 GPTQ 路径借助 ExLlama 能在内存紧张时压缩量化权重,但不同模型家族的支持程度不一,动手前最好先查看对照表。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。