Back to news
launchMiniMax2025-06-17

MiniMax open-sources M1 hybrid-attention model

M1 支持 100 万 token 上下文与 8 万 token 推理输出,采用 Lightning Attention 机制。

2025年6月17日,MiniMax 发布并开源 MiniMax-M1,全球首个开源的大规模混合架构推理模型。M1 采用混合专家架构(总参数 4560 亿、每 token 激活 45.9 亿、32 个专家)结合 Lightning Attention 机制,原生支持 100 万 token 上下文,推理输出最高 8 万 token,是当时上下文最长的推理模型。其强化学习训练仅用 512 块 H800 三周、成本 53.7 万美元。API 定价 0 至 20 万 token 区间为输入 0.4 美元、输出 2.2 美元每百万 token。

M1开源长上下文