输入文本文本
它是什么
MiniMax-M1 是 MiniMax 于 2025 年 6 月发布的开放权重推理模型。MiniMax 由闫俊杰等人于 2021 年在上海创立。M1 采用混合注意力设计,把标准的全注意力层与线性注意力层组合,用以降低长序列推理的算力开销,官方给出的上下文窗口达到百万 token 量级。它总参数 456B、每 token 激活约 46B,是一个大规模 MoE 推理模型,权重以开放许可发布。公司同时经营海螺等生成产品线。
为什么值得记住
把线性注意力与全注意力混用,并把上下文推到百万 token,用来压低长序列推理的开销;它是规模可观的开放权重推理模型之一,是开放权重阵营在推理赛道上的一个具体落点。
关键规格
- 参数规模
- 456B(MoE,激活约 46B)
- 上下文窗口
- 1M tokens
- 架构
- 线性注意力与全注意力混合
- 开放权重
- 是
所属能力
相关概念
同类产品
DeepSeek-R1
2025DeepSeek
用强化学习训练推理链、权重以 MIT 许可开放的推理模型
模型 开放权重
文本文本
Qwen
2023Alibaba (Qwen)
覆盖多规格、含多模态版本的开放权重模型家族
模型 开放权重
文本图像文本
o3
2025OpenAI
回答前先生成长的推理链,用推理时的算力换更稳的正确率
模型 闭源
文本图像文本
GLM
2023Zhipu AI
以自回归填空预训练起步的中文通用模型
模型 闭源
文本文本
Doubao
2023ByteDance (Seed)
字节跳动的通用对话模型与应用
模型 闭源
文本图像文本
Step
2023StepFun
面向多模态与端侧的通用模型系列
模型 闭源
文本图像文本