
图片:METAL
摘要
- 阿里巴巴于8月3日正式发布Qwen3.8 Max。该模型采用2.4万亿参数MoE架构,上下文窗口达100万token,但推理时实际激活的参数数量并未公开。
- METAL LAB在Qwen Studio上直接提问,模型本身也回答"并不确定"。海外媒体的推测数字也分歧较大,分别约为950亿和220亿。
- 公开权重的是27B版本模型。自2025年9月Qwen3-Max以来,旗舰模型无一例外均为纯API方式提供,3.8 Max也延续了这一惯例。
阿里巴巴于8月3日正式发布了旗舰模型Qwen3.8-Max。该模型采用总计2.4万亿参数的混合专家(MoE)架构,上下文窗口达100万token。距7月19日预览版首次亮相仅过去半个月。
数字确实庞大。但在这次发布中,有一个数字始终未被确认。
直接问了模型本身
METAL LAB登录Qwen Studio(chat.qwen.ai),直接向Qwen3.8-Max提问:总参数量和推理时实际激活的参数量各是多少。并附加条件:如不确定请直接说不知道。得到的第一句回答是这样的:
我并不能确定Qwen3.8-Max的总参数数量以及单次推理时实际激活的参数数量。
不过接下来的解释反而相当准确。总参数被定义为"模型所拥有的全部专家网络和共享层在内的总参数量",激活参数则被解释为"在处理特定输入token时,路由器所选择的部分专家网络实际参与计算所使用的参数规模"。同时它还指出,内存加载成本取决于总参数量,而每个token的计算成本则与激活参数量成正比。
韩语回答的质量相当不错,没有翻译腔,路由器、前向传播、共享层等术语的使用也都恰当。不过未登录状态下,交流一次之后就会弹出注册窗口。
无人知晓激活参数
模型不清楚自身规格并不奇怪。训练数据里本就没有理由包含自身的技术说明卡。问题在于阿里巴巴同样没有公布这个数字。
因此海外媒体的推测出现分歧。InfoWorld报道称推理时约激活950亿个参数,而战略分析媒体Forewarned MBA则估计每个token约激活220亿个。两者相差超过四倍。
在MoE架构中,这个数字为何重要?2.4万亿说明模型建造得有多大,而激活参数则说明运行它每次要花费多少。企业在评估引入与否时,真正拿计算器核算的是后者。如果头条数字很大而实际数字未公开,那么这份发布与其说是性能公告,不如说更接近规模炫耀。

Qwen三年——一条从开放走向收拢的轨迹
Qwen是以开放权重闻名的模型系列。自2023年8月Qwen-7B起步,陆续开放了14B、72B,2024年的Qwen2、2.5,乃至2025年的Qwen3,主力模型一直持续开放。它几乎可以说是中国开源生态的象征。
| 时间 | 模型 | 权重 |
|---|---|---|
| 2023.08 | Qwen-7B | 公开 |
| 2024.09 | Qwen2.5 | 公开 |
| 2025.04 | Qwen3 | 公开 |
| 2025.09 | Qwen3-Max | 仅限API |
| 2026.02 | Qwen3.5 (397B-A17B) | 公开 |
| 2026.04 | Qwen3.6-Plus / 3.6-Max预览版 | 仅限API |
| 2026.04 | Qwen3.6-27B | 公开 |
| 2026.05~06 | Qwen3.7-Max / 3.7-Plus | 仅限API |
| 2026.08 | Qwen3.8-Max | 仅限API |
纵向读这张表,能看出一条清晰的线索。自2025年9月Qwen3-Max起,Max系列无一例外均为纯API方式提供。而真正开放的是27B、397B这类中小规模模型。这次也不例外,下周将在Model Studio上开放的是Qwen3.8-27B,而不是2.4万亿参数的本体。

"开放权重"这个说法始终伴随着这次发布,但它所指的对象,并非标题里的那个模型。
各项基准测试成绩互有胜负
阿里巴巴选定的对比对象是Claude Opus 4.8、Claude Fable 5和GPT-5.6 Sol。结果并未呈现一边倒的局面。
| 基准测试 | Qwen3.8-Max | 对比对象 |
|---|---|---|
| Terminal-Bench 2.1 | 86.6 | Claude Opus 4.8 — 84.6 |
| SWE-bench Pro | 67.7 | Claude Fable 5 — 80.0 |
| PaperBench | 93.0 | — |
| GPQA Diamond | 92.6 | — |
在终端任务上占优。而在需要修复真实代码仓库问题的SWE-bench Pro上,差距超过12分。阿里巴巴自己也将该模型定位为"仅次于Fable 5"。这份发布并未宣称自己是第一,这一点值得记录。
团队负责人离职后的首款旗舰产品
解读这款模型时,不能忽略一个背景。今年3月5日,阿里巴巴批准了Qwen技术负责人林俊旸的离职申请。他正是把Qwen塑造成今日模样的关键人物。
一天后,阿里巴巴宣布成立由CEO吴泳铭、阿里云CTO周靖人及吴泽明共同领导的AI模型专项工作组。吴泳铭在内部信中表示,将集中集团资源加速基础模型研发,并明确表态"将继续坚持开源模型战略"。这带有明显的事后补救色彩。后训练工作则由来自DeepMind的周昊负责。
Qwen3.8 Max正是在这一新体制下推出的首款旗舰产品。而五个月前的那句承诺,最终以"开放27B、锁闭2.4万亿"的形式得以兑现。

真正的发布在下周
Forrester分析师Charlie Dai评价称,企业现在拥有了可以替代独家前沿模型的可靠选项,尤其是在软件工程领域。Gartner分析师Nitish Tyagi则认为,开放权重、MoE架构与100万token上下文窗口的组合,是让AI辅助开发在经济上真正可行的又一步进展。
不过,分析师们共同指出的一句话,几乎可以概括这次发布的实质:开放API与开放权重是两回事。
下周将开放什么内容、以何种许可、开放到何种规模,将决定这次发布的分量。在此之前,2.4万亿仍是一个无法被验证的数字。





评论