#62 · 主分类: 基础模型
MiniMax-M1
large-language-models
llm
minimax-m1
reasoning-models
MiniMax-M1,全球首个开放权重的大规模混合注意力推理模型。
项目最后更新:07/07/25
GitHub Stars
3.2K
Forks数量
283
贡献者数量
4
许可证
Apache-2.0
收录理由
MiniMax-M1 是一款开放权重的推理模型,核心在于混合注意力架构:它将标准注意力与线性“闪电”注意力机制结合,论文表明这种设计能高效扩展测试时计算,对于需要大量链式思考推理、按量付费的场景尤为关键。权重完全公开,你可以自行部署到自己的服务栈,或针对特定领域做微调,不必被单一封闭 API 绑定。对正在权衡开源推理模型与商业方案的团队来说,它提供了一条真正可选的路径。仓库本身简洁明了,包含了架构说明、基准测试结果以及小型团队上手所需的部署指引,是了解与使用该模型的直接入口。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。