#62 · 主分类: 基础模型

MiniMax-M1

large-language-models llm minimax-m1 reasoning-models

MiniMax-M1,全球首个开放权重的大规模混合注意力推理模型。

项目最后更新:07/07/25

GitHub Stars

3.2K

Forks数量

283

贡献者数量

4

许可证

Apache-2.0

收录理由

MiniMax-M1 是一款开放权重的推理模型,核心在于混合注意力架构:它将标准注意力与线性“闪电”注意力机制结合,论文表明这种设计能高效扩展测试时计算,对于需要大量链式思考推理、按量付费的场景尤为关键。权重完全公开,你可以自行部署到自己的服务栈,或针对特定领域做微调,不必被单一封闭 API 绑定。对正在权衡开源推理模型与商业方案的团队来说,它提供了一条真正可选的路径。仓库本身简洁明了,包含了架构说明、基准测试结果以及小型团队上手所需的部署指引,是了解与使用该模型的直接入口。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目