
이미지: AI 생성 — METAL LAB
- 공개
- 2026년 8월 3일 (프리뷰 7월 19일)
- 구조
- 전체 2.4조 파라미터 · 전문가 혼합(MoE)
- 활성 파라미터
- 비공개 — 외신 추정 220억~950억으로 갈림
- 컨텍스트
- 100만 토큰 (입력 최대 99만 1천 / 출력 최대 13만 1천)
- 터미널벤치 2.1
- 86.6 — 클로드 오퍼스 4.8(84.6)보다 앞섬
- SWE-bench Pro
- 67.7 — 클로드 페이블 5(80.0)에 12.3점 뒤짐
- 기타 벤치마크
- 페이퍼벤치 93.0 · GPQA 다이아몬드 92.6
- 가중치
- 다음 주 모델 스튜디오 공개 예정 — 대상은 큐원3.8-27B
- 직접 써보기
- 큐원 스튜디오 (비로그인 1회 대화 가능)
阿里巴巴于8月3日正式发布了旗舰模型Qwen3.8 Max。该模型采用总计2.4万亿参数的混合专家(MoE)架构,上下文窗口达100万token。这距离其7月19日以预览版首次亮相仅半个月。
数字很庞大。但在这次发布中,有一个数字始终没有被确认。
直接问了模型本身
METAL LAB登录Qwen Studio(chat.qwen.ai),直接向Qwen3.8 Max提问:总参数和推理时的激活参数各是多少?并附加了一条条件——如果不确定就直接说不知道。得到的第一句回答是这样的:
我并不确切知道Qwen3.8-Max的总参数数量,以及每次推理时实际激活的参数数量。
随后的说明反倒相当准确。它将总参数定义为"模型所拥有的全部专家和共享层的总参数量",将激活参数定义为"处理特定输入token时,由路由器选中的部分专家实际参与计算的参数规模"。并总结道,内存加载成本取决于总参数,而每个token的计算成本则与激活参数成正比。
韩语回答的质量不错。没有翻译腔,路由器、前向传播、共享层等术语的使用也很到位。不过在未登录状态下,一轮问答结束后就会弹出注册窗口。
没有人知道激活参数数量
模型不了解自身规格并不奇怪。训练数据中没有理由包含自己的模型卡。问题在于,阿里巴巴也没有公开这个数字。
因此外媒的估算出现分歧。InfoWorld报道称推理时约激活950亿个参数,战略分析媒体4Weeks MBA则认为每个token约激活220亿个。两者相差超过四倍。
在MoE架构中,这个数字为何重要?2.4万亿说明模型建得有多大,而激活参数说明每次运行它要付出多少成本。企业在评估是否采用时,真正拿计算器算的是后者。如果只有headline数字很大,而真正的数字未公开,那这次发布与其说是性能公告,更像是规模炫耀。

Qwen的三年——从开放走向封闭的轨迹
Qwen是靠开放权重而声名远扬的名字。从2023年8月的Qwen-7B开始,接连开放了14B、72B版本,2024年的Qwen2、2.5,直到2025年的Qwen3,主力模型一直保持开放。这几乎成了中国开放生态的象征。
| 时间 | 模型 | 权重 |
|---|---|---|
| 2023.08 | Qwen-7B | 开放 |
| 2024.09 | Qwen2.5 | 开放 |
| 2025.04 | Qwen3 | 开放 |
| 2025.09 | Qwen3-Max | 仅限API |
| 2026.02 | Qwen3.5 (397B-A17B) | 开放 |
| 2026.04 | Qwen3.6-Plus / 3.6-Max预览版 | 仅限API |
| 2026.04 | Qwen3.6-27B | 开放 |
| 2026.05~06 | Qwen3.7-Max / 3.7-Plus | 仅限API |
| 2026.08 | Qwen3.8-Max | 仅限API |
纵向阅读这张表,可以看出一条清晰的线。自2025年9月的Qwen3-Max起,Max系列无一例外都仅限API调用。真正开放的是27B、397B这类中小规模模型。这一次,下周将在Model Studio开放的也是Qwen3.8-27B,而不是那个2.4万亿参数的本体。
"开放权重"这个说法一直伴随着这次发布,但它所指的对象并不是标题中的那个模型。
各项基准测试结果不一
阿里巴巴设定的比较对象是Claude Opus 4.8、Claude Fable 5和GPT-5.6 Sol。结果并未一边倒。
| 基准测试 | Qwen3.8-Max | 比较对象 |
|---|---|---|
| Terminal-Bench 2.1 | 86.6 | Claude Opus 4.8 — 84.6 |
| SWE-bench Pro | 67.7 | Claude Fable 5 — 80.0 |
| PaperBench | 93.0 | — |
| GPQA Diamond | 92.6 | — |
在终端任务中它领先。但在需要修复真实代码库问题的SWE-bench Pro上,差距超过12分。阿里巴巴自己也将其模型描述为"仅次于Fable 5"。这场发布并未宣称自己是第一,这一点值得记录。
团队负责人离职后的首款旗舰模型
解读这款模型时,不能忽略一个背景。今年3月5日,阿里巴巴批准了Qwen技术负责人林俊旸的辞职。他正是将Qwen塑造成今天这个样子的人物。
一天后,阿里巴巴宣布成立由CEO吴泳铭、阿里云CTO周靖人及吴泽明共同领导的AI模型任务组。吴泳铭在内部信中表示,将整合集团资源加速基础模型开发,并明确表示"将继续坚持开源模型战略"。这一举措带有明显的事后补救性质。后训练工作则由来自DeepMind的周昊负责。
Qwen3.8 Max正是这一新体制下诞生的首款旗舰模型。而五个月前的那个承诺,最终以开放27B、封闭2.4万亿的方式落实。

真正的发布在下周
Forrester的Charlie Dai评价称,企业现在拥有了可以替代闭源前沿模型的可靠选项,尤其是在软件工程领域。Gartner的Nitish Tyagi则认为,开放权重、MoE架构与100万token上下文窗口的组合,是让AI辅助开发在经济上更加可行的一步进展。
不过,分析师们共同指出的一句话,几乎概括了这次发布的实质:开放API和开放权重是两件不同的事。
下周开放的内容是什么、以何种许可、开放到何种规模,将决定这次发布的实际分量。在此之前,2.4万亿仍将是一个无法验证的数字。


