阿里在 2026 年 7 月 19 日发布了 Qwen3.8-Max-Preview,并给出一个没法忽视的说法:一个 2.4 万亿参数的旗舰,用它自己的话说,"仅次于 Fable 5"。它没有发布的,是任何支撑这句话的基准表——没有分数、没有激活参数量、没有 MoE 配置。权重承诺"即将"开源,没有日期。首批独立实测的口风,从不冷不热到公开开炮。这一页在整个预览期把官方、泄露、实测三样分开摆——而在 8 月 3 日,真数字落地了:正式发布、整桌基准、$2/$6 的在线 API、带日期的开源承诺。对账单在下面,逐条对着本页的记录打分。
8 月 3 日:对账单
追了两周的主张,逐条对上正式发布(完整拆解与价格分析见发布深度文):
| 本页追踪的 | 落地的答案 |
|---|---|
| 2.4T 参数、激活量不明 | 确认——每 token 激活约 95B 终于进了官方口径 |
| 上下文之争:报道 200K vs 界面 1M | 官方 1M:最大输入 991K、最大输出 131K |
| 零份公开基准 | 整桌厂商基准:Terminal-Bench 2.1 86.6(高于 Opus 4.8 的 84.6)、SWE-bench Pro 67.7、PaperBench 93.0——外加人群盲评的 Arena:WebDev 第 4、Text 第 5、Vision 第 2 |
| "仅次于 Fable 5" | 编码上不成立——SWE-bench Pro 67.7 对 Fable 5 的 80.0。在 agent 和研究类基准上说得通,作为一句关于厂商跑分的话 |
| 权重"即将"开源、且有 Qwen3.6-Max 前科 | 具体且带日期的承诺:2.4T 的 Max 和 27B 小版本,发布一周内上 Hugging Face 和 ModelScope |
| 只能走 Token Plan 订阅 | 公开 API 上线:输入 $2 / 输出 $6、缓存 $0.25 |
预览期的怀疑,在营销话术这条上赢了——"仅次于 Fable 5"没扛住阿里自家的编码数字;现在它转场去盯权重的钟:"下周"终于有了日期范围,交付或跳票,本页都记。
官方、泄露、实测——预览期存档
官方(阿里自己的口径):
- Qwen3.8-Max-Preview 已上线,首发渠道是阿里的 Token Plan 订阅和 Qoder 编码工具。
- 头条数字:2.4 万亿参数。未公布激活参数量与专家配置——在模型卡说清每个 token 点亮多少之前,2.4T 只是一个营销数字。
- 官方定位原话:当今最强模型之一,"仅次于 Fable 5"。
- 权重承诺"即将"开源。无日期、无许可证。注意前科:Qwen3.6-Max 当初也是类似口风,最后始终闭源、只在阿里自家平台托管。
泄露(社区流传的内部数字,未经证实):
- 编码:落后 Claude Fable 5 12.6 分,并声称 73.2% 的编码输出与 Fable 5 一致。
- Cowork(400 个真实任务的 agent 评测):领先 Opus 4.8 Max 5 分、Kimi K3 8 分、GLM-5.2 17.1 分、领先上代 Qwen3.7-Max 44.4 分。
- 以上每一条都按泄露对待。阿里一条都没正式发过,而内部评测的泄露数字,碰上独立复测常常会缩水。
实测(上线头 24 小时):
- 最狠的公开结论来自一位独立开发者的基准实测:"不是 Fable 5 级,差得远"——并直言这种营销是误导。
- 中文社区(把这模型锤得最狠的地方)的反馈:默认文风偏呆板、提示词写得足够具体才会明显改善;偶发自我认知混乱;渲染管线类输出在不给详细提示时被测试者排在 GLM-5.2 之下。
- 连上下文长度都没定论:常见说法是 200K,而 Token Plan 界面里能调到 1M。模型卡出来之前,两个数都只能当临时的。
- *一周风评转向(7 月 24 日):*口碑正从开炮转向毁誉参半。一则流传很广的实测里,用 Qwen3.8-Max 写的后端项目通过了 Claude Fable 5 的代码审查,拿到"代码质素相当高"的评语——但"雷霆大思考"的漫长停顿和偶发的领域理解偏差仍在。阿里同时给更小的 Qwen3.6-27B 开了周末限免不限量活动:铺量攻势全面展开。
诚实的总结是:主张是贴近前沿的,证据还不是。这不等于模型弱——Qwen3.7 是真有实力的,发布日的 harness 问题也常让强模型显得笨。它只说明:阿里以外,现在没人说得清。
这件事落在什么格局里
Qwen3.8 是 2026 年 7 月三周内的第三个万亿级国产发布——前有 Kimi K3(2.8T,7 月 16 日),旁边是呼之欲出的 DeepSeek V4 正式版——马斯克那边还说 Grok 4.6 的 2T 训练几天内收尾。军备竞赛是真的,一个不那么可爱的新模式也是真的:"承诺开源"正在变成发布会配件。K3 发布时权重承诺"7 月 27 日前";Qwen3.8 发布时权重"即将"——而这家实验室上一个 Max 级模型悄悄地始终没开。现在宣布开源,买到的是开源光环;之后交不交付,是另一个决定。这一页会一直盯着这个差别,因为对开发者,这是"能审计的模型"和"一张定价页"的全部区别。
今天真正能用上的
上架排队随正式发布结清了:Qwen3.8-Max 的公开 API 已上线,$2/$6、缓存 $0.25——不再需要 Token Plan 订阅包。现在就能用的,在 Turiloop 一个 OpenAI 兼容 Key 背后:Qwen3.7-Max 和 Qwen3.7-Plus——旁边是 GLM-5.2、DeepSeek V4 和 Kimi。国际卡、免中国手机号。Qwen3.8 随上架加入阵容——切换只是改一个 model id——价格计算器同日收录。
常见问题
Qwen3.8 是什么? 阿里的旗舰模型系列:2026 年 7 月 19 日以 Qwen3.8-Max-Preview 预览,8 月 3 日正式发布——2.4 万亿参数、激活约 95B、1M 上下文、API 定价 $2/$6,权重承诺发布后一周内开源。完整分析见发布深度文。
Qwen3.8 开源了吗? 还没有——但承诺在 8 月 3 日发布时变具体了:2.4T 的 Max 和 27B 小版本的权重,承诺一周内上 Hugging Face 和 ModelScope。这将是 Max 级 Qwen 的史上首次开源;许可条款尚未公布。交付与否,本页更新。
Qwen3.8 真的仅次于 Fable 5 吗? 官方数字现在把结论劈成两半。编码上,不:阿里自家的 SWE-bench Pro 是 67.7,Fable 5 是 80.0。在 agent 和研究类基准上(Terminal-Bench 2.1 86.6、PaperBench 93.0)说得通——作为一句关于厂商跑分、待独立复测的话。
怎么用上 Qwen3.8? 官方 API 自 8 月 3 日起上线,$2/$6。通过 Turiloop 这类 OpenAI 兼容网关,Qwen3.7-Max 和 3.7-Plus 今天就能用国际卡调用、免中国手机号;Qwen3.8 随上架加入。
Qwen3.8 和 Kimi K3 怎么比? 两边都有真数字了:K3 守住 Terminal-Bench 2.1(88.3 对 86.6)和一个月的独立检验;Qwen3.8-Max 在研究和系统操控类基准上还手,而且卖 $2/$6 对 K3 的 $3/$15——输出价不到一半。见 K3 拆解与 Qwen3.8 发布深度文。