简介
- Qwen3.8-Max 运行 2.4 万亿参数,是阿里巴巴将作为开放权重发布的首个 Max 级 Qwen 模型。
- 它附带 Anthropic 的 Claude Code 和 OpenAI 的 Codex(竞争对手工具)的设置说明。
- 在阿里巴巴自己的基准测试表中,Fable 5 在 31 项测试中赢得 15 项。Qwen3.8-Max 赢得 7 项。
阿里巴巴周一发布了 Qwen3.8-Max,称其为自己构建过的最强大的模型。权重将于下周在 Hugging Face 和 ModelScope 上发布——这是该公司首次以 Max 规模免费提供模型。
规格很大:总参数 2.4 万亿,但任何时刻只有 950 亿被激活。参数是模型能够处理的旋钮数量。
这对效率极其重要,因为这意味着运行它不需要太多资源。可以把它想象成一个巨大的图书馆,每个问题只有相关的书架亮起。拥有足够好硬件的小企业和实验室现在能够运行最先进的模型,而无需花费大型数据中心那样的成本。
阿里巴巴的发布文章跳过了通常的基准追逐叙事,而是强调耐力。该模型花了 16 天独自构建一个编码工具——265 次提交、127 个拉取请求、151 个问题,没有人类触碰键盘。它花了五天时间复现一篇从未见过代码的研究论文,然后以 2.7 分的优势超过了论文自己的结果。在一场 24 小时的机器学习竞赛中,它在 526 个人类团队中排名第 458 位之前。
为在竞争对手的工具中运行而构建
Qwen3.8-Max 附带 Claude Code 和 Codex(Anthropic 和 OpenAI 制作的编码工具)的说明。阿里巴巴的 API 使用两家公司的协议。其大部分编码基准测试都是在 Claude Code 中运行的。
这些基准测试并不讨好它。在 31 项文本测试中,Anthropic 的 Fable 5 获得 15 个第一名,OpenAI 的 GPT-5.6 Sol 获得 9 个,Qwen 获得 7 个。在 12 项编码测试中,Qwen 恰好赢得一项。然而,在智能成本方面,这个模型极其便宜且高效,这意味着即使它需要更多的迭代或推理,完成工作的成本也会低得多,大约是 Claude Fable 5 收费的 30%。

话虽如此,转向多模态工作——文档、视频、空间推理——排名则发生逆转。Qwen 在该榜单的大部分项目中领先。
在商业策略方面也存在逆转。4月,阿里巴巴取消了 Qwen Code 的免费层,在领导层离职后,团队逐渐转向封闭的付费模型。我们对 Qwen 3.7 Max 的评测指出,Plus 版本将保持开放,而 Max 仍锁定在 API 之后。
那扇门现在打开了,时机并非偶然。中国开放权重模型在 OpenRouter 上的 token 占比从 2024 年底的不到 2% 上升到 2026 年中期的约 61%。Qwen 超越了 Meta 的 Llama,成为全球最广泛自托管的模型。
与此同时,华盛顿在6月根据出口管制限制了 Fable 5 和 Mythos 5,而北京据报道也在考虑对中国模型出海设置自己的限制。
所以,阿里巴巴在纸面上失利,但在分发上获胜。如果你能免费下载到接近的东西,第二名也是一个不错的位置。






