[中国] on AI 中国智能 · THE OTHER RIVER
← 返回中国脉搏
labs · 2026年7月14日

传MiniMax秘密研发参数规模2.7万亿的M3 Pro,拟三季度开源MiniMax reportedly developing 2.7-trillion-parameter M3 Pro, eyeing Q3 open-source release

不妨想象一下,这样一个数字第一次被写下来时,是在什么样的房间里。不是发布会的舞台,也不是新闻通稿的排期表。而是两个知情人,加一位足够有耐心、能让他们开口的记者。这篇报道就是从这样一个房间里流出来的——在琢磨数字本身之前,这个出处本身就值得先琢磨一下。

这个数字是2.7万亿。据The Information独家报道——援引两位知情人士,均未具名,公司方面也没有任何声明——总部位于上海、以开源M3模型闻名的稀宇科技(MiniMax),正在研发一款内部代号为"M3 Pro"的下一代大模型。这个名字发布前可能会变,但如果爆料属实,规模只会往大了走,不会往小了缩。

一条消息,从美国财经媒体的独家简报,原封不动地流进中国科技媒体——沿途没有采到一位当事人的声音。
原文 · 一手信源
据 The Information 消息,稀宇科技计划推出 2.7 万亿参数规模的新一代大模型。这款新模型在内部的代号为 M3 Pro,该模型预计最早将于今年第三季度发布并开源。目前 MiniMax M3 总参数 428B(4280 亿),激活参数 23B。
According to The Information, Xiyu Technology (MiniMax) plans to launch a new-generation model with a 2.7-trillion-parameter scale. The new model's internal codename is M3 Pro, expected to launch and open-source as early as Q3 this year. The current MiniMax M3 has 428B total parameters (428 billion), with 23B active parameters.
新浪科技 (Sina Tech), "消息称稀宇科技 MiniMax 计划推出参数规模 2.7 万亿新一代大模型" · 来源 ↗
原文 · 一手信源
消息人士透露,该新模型旨在大幅增强处理复杂推理和多步任务的能力。目前尚无法确认 MiniMax 官方是否会证实这一消息。
Sources say the new model is intended to substantially enhance its ability to handle complex reasoning and multi-step tasks. It remains unconfirmed whether MiniMax will officially verify this report.
IT之家 (IT Home), "消息称稀宇科技 MiniMax 计划推出参数规模 2.7 万亿新一代大模型" · 来源 ↗

要理解这个数字有多惊人,得先看基准线。MiniMax现有的旗舰模型M3于6月1日开源,总参数4280亿(428B),激活参数230亿(23B)——一套稀疏混合专家(MoE)架构,赌的是:不必让每一个参数都醒着思考,只要在对的时刻唤醒对的那一小撮就够了。新浪科技的报道把这笔账算得很直白:"总参数428B(4280亿),激活参数23B"——这是现有模型,是接下来要乘出来的那个基数。而2.7万亿参数的M3 Pro,相当于这个基数的六倍还多。这已经不是一次迭代升级,而是完全换了一个量级的故事。

IT之家的转述把这款新模型的野心概括成一句话:"大幅增强处理复杂推理和多步任务的能力"——也就是说,要让模型在更长的推理链条、更复杂的多步任务里不掉线、不断线。当然,这只是"消息人士"的说法,既没有官方确认,也没有一个字来自MiniMax本身。

值得在这个信息缺口里多停留一下。这条消息由一家美国媒体率先捅出,几天之内,两家中国财经科技媒体先后转载,但都老老实实地把消息来源标注回The Information,都注明是"消息人士透露"。没有一家补上MiniMax的官方回应,没有一条公众号推送,没有一条微博,没有一位工程师出来确认或者否认。MiniMax自己的沉默,恰恰是这整件事里最"中国式信源"的一个细节——需要说清楚的是:这是沉默,不是默认。你现在读到的,是一条从美国简报室一路传到中国科技媒体、却始终没能采到一个当事人声音的传闻。

那为什么还要认真对待它?因为这类规模数字更像是一条大河边上的路标,而不是终审判决。半年前,开源大模型的参数天花板还是Llama 4的4000亿;接着是DeepSeek-V3的6850亿;再往后是腾讯混元Hy3的2950亿(激活参数,MoE架构);然后是MiniMax自家M3的4280亿,证明了稀疏注意力路线足以对抗体量大得多的稠密模型。每一次发布,都在重新定义"你能自己下载、自己跑起来的最大模型"这句话的含义。如果M3 Pro真的做到了接近2.7万亿参数——而且是以开源权重的形式,不是按token计费的API——那它又一次刷新了这条边界,顺带也让"把前沿算力规模关在付费墙后面"这种做法,看起来更像是一种暂时的策略,而不是一道守得住的护城河。

但请注意上一句里那个"如果",它扛着整段论证的分量。目前手头只有一篇报道、两个匿名信源、零官方确认,外加一个企业们向来常常爽约的"三季度"时间表。不妨把它当成一份天气预报来对待——这个信源过去判断准过,但这一次的这场风暴,它还没有真正报出来。真正该盯的,是MiniMax自己开口的那一刻:一条公众号文章,一份模型卡,哪怕是一位工程师的一句微博。在那之前,这个故事最诚实的状态,是它还不是MiniMax讲出来的故事——它是一群不是MiniMax的人,讲的一个关于MiniMax的故事。而这,恰恰就是这条新闻全部的价值所在。