每天早晨,用三行读完全球 AI 动态浏览品牌目录

METAL LAB

Qwen3.8 Max发布……2.4万亿参数中激活多少未公开

即使直接询问模型本身,它也表示不清楚。旗舰模型再次仅限API调用,开放权重的只有27B版本。

이미지: AI 생성 — METAL LAB

공개
2026년 8월 3일 (프리뷰 7월 19일)
구조
전체 2.4조 파라미터 · 전문가 혼합(MoE)
활성 파라미터
비공개 — 외신 추정 220억~950억으로 갈림
컨텍스트
100만 토큰 (입력 최대 99만 1천 / 출력 최대 13만 1천)
터미널벤치 2.1
86.6 — 클로드 오퍼스 4.8(84.6)보다 앞섬
SWE-bench Pro
67.7 — 클로드 페이블 5(80.0)에 12.3점 뒤짐
기타 벤치마크
페이퍼벤치 93.0 · GPQA 다이아몬드 92.6
가중치
다음 주 모델 스튜디오 공개 예정 — 대상은 큐원3.8-27B

阿里巴巴于8月3日正式发布了旗舰模型Qwen3.8 Max。该模型采用总计2.4万亿参数的混合专家(MoE)架构,上下文窗口达100万token。这距离其7月19日以预览版首次亮相仅半个月。

数字很庞大。但在这次发布中,有一个数字始终没有被确认。

直接问了模型本身

METAL LAB登录Qwen Studio(chat.qwen.ai),直接向Qwen3.8 Max提问:总参数和推理时的激活参数各是多少?并附加了一条条件——如果不确定就直接说不知道。得到的第一句回答是这样的:

我并不确切知道Qwen3.8-Max的总参数数量,以及每次推理时实际激活的参数数量。

随后的说明反倒相当准确。它将总参数定义为"模型所拥有的全部专家和共享层的总参数量",将激活参数定义为"处理特定输入token时,由路由器选中的部分专家实际参与计算的参数规模"。并总结道,内存加载成本取决于总参数,而每个token的计算成本则与激活参数成正比。

韩语回答的质量不错。没有翻译腔,路由器、前向传播、共享层等术语的使用也很到位。不过在未登录状态下,一轮问答结束后就会弹出注册窗口。

没有人知道激活参数数量

模型不了解自身规格并不奇怪。训练数据中没有理由包含自己的模型卡。问题在于,阿里巴巴也没有公开这个数字

因此外媒的估算出现分歧。InfoWorld报道称推理时约激活950亿个参数,战略分析媒体4Weeks MBA则认为每个token约激活220亿个。两者相差超过四倍。

在MoE架构中,这个数字为何重要?2.4万亿说明模型建得有多大,而激活参数说明每次运行它要付出多少成本。企业在评估是否采用时,真正拿计算器算的是后者。如果只有headline数字很大,而真正的数字未公开,那这次发布与其说是性能公告,更像是规模炫耀。

半开的保险柜门——这次发布的核心在于开放的边界在哪里
图片:AI生成 — METAL LAB

Qwen的三年——从开放走向封闭的轨迹

Qwen是靠开放权重而声名远扬的名字。从2023年8月的Qwen-7B开始,接连开放了14B、72B版本,2024年的Qwen2、2.5,直到2025年的Qwen3,主力模型一直保持开放。这几乎成了中国开放生态的象征。

时间模型权重
2023.08Qwen-7B开放
2024.09Qwen2.5开放
2025.04Qwen3开放
2025.09Qwen3-Max仅限API
2026.02Qwen3.5 (397B-A17B)开放
2026.04Qwen3.6-Plus / 3.6-Max预览版仅限API
2026.04Qwen3.6-27B开放
2026.05~06Qwen3.7-Max / 3.7-Plus仅限API
2026.08Qwen3.8-Max仅限API

纵向阅读这张表,可以看出一条清晰的线。自2025年9月的Qwen3-Max起,Max系列无一例外都仅限API调用。真正开放的是27B、397B这类中小规模模型。这一次,下周将在Model Studio开放的也是Qwen3.8-27B,而不是那个2.4万亿参数的本体。

"开放权重"这个说法一直伴随着这次发布,但它所指的对象并不是标题中的那个模型。

各项基准测试结果不一

阿里巴巴设定的比较对象是Claude Opus 4.8、Claude Fable 5和GPT-5.6 Sol。结果并未一边倒。

基准测试Qwen3.8-Max比较对象
Terminal-Bench 2.186.6Claude Opus 4.8 — 84.6
SWE-bench Pro67.7Claude Fable 5 — 80.0
PaperBench93.0
GPQA Diamond92.6

在终端任务中它领先。但在需要修复真实代码库问题的SWE-bench Pro上,差距超过12分。阿里巴巴自己也将其模型描述为"仅次于Fable 5"。这场发布并未宣称自己是第一,这一点值得记录。

团队负责人离职后的首款旗舰模型

解读这款模型时,不能忽略一个背景。今年3月5日,阿里巴巴批准了Qwen技术负责人林俊旸的辞职。他正是将Qwen塑造成今天这个样子的人物。

一天后,阿里巴巴宣布成立由CEO吴泳铭、阿里云CTO周靖人及吴泽明共同领导的AI模型任务组。吴泳铭在内部信中表示,将整合集团资源加速基础模型开发,并明确表示"将继续坚持开源模型战略"。这一举措带有明显的事后补救性质。后训练工作则由来自DeepMind的周昊负责。

Qwen3.8 Max正是这一新体制下诞生的首款旗舰模型。而五个月前的那个承诺,最终以开放27B、封闭2.4万亿的方式落实。

即便权重开放,能否承接并运行如此规模也是另一个问题
图片:AI生成 — METAL LAB

真正的发布在下周

Forrester的Charlie Dai评价称,企业现在拥有了可以替代闭源前沿模型的可靠选项,尤其是在软件工程领域。Gartner的Nitish Tyagi则认为,开放权重、MoE架构与100万token上下文窗口的组合,是让AI辅助开发在经济上更加可行的一步进展。

不过,分析师们共同指出的一句话,几乎概括了这次发布的实质:开放API和开放权重是两件不同的事。

下周开放的内容是什么、以何种许可、开放到何种规模,将决定这次发布的实际分量。在此之前,2.4万亿仍将是一个无法验证的数字。