#54 · 主分类: 基础模型
matmulfreellm
large-language-model
linear-transformer
llm
MatMul-free语言模型的实现
项目最后更新:12/02/25
GitHub Stars
3.1K
Forks数量
201
贡献者数量
9
许可证
Apache-2.0
收录理由
关注高效大模型架构的开发者,大概率会在这个仓库里找到有价值的东西。它实现了 MatMul-Free LM,一种把标准 Transformer 核心中的矩阵乘法整个拿掉的设计,用三元权重和门控循环注意力替代了大部分线性层。关键在于这种取舍:省下大量 FLOPs 和内存占用,同时生成质量仍能贴近传统模型。仓库直接提供了 370M、1.3B 和 2.7B 的预训练权重,加载时走 Hugging Face 标准的 AutoModel 接口,无论是跑生成还是做微调,都不用额外折腾。代码改编自 flash-linear-attention,熟悉那个库的人能很快看出三元量化是怎么嵌进熟悉的线性注意力框架里的。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。