Qwen 3.8-Max 发布:2.4 万亿参数开放权重预览版上线

阿里通义千问 3.8-Max 以 2.4 万亿参数规模上线预览版,定位"仅次于 Fable 5"。预览版已登陆 TokenPlan、Qoder、QoderWork 及千问 PC/Web 端,正式版与开放权重近期同步发布,宣告中国开源大模型进入万亿参数时代。
2026 年 7 月 19 日,阿里巴巴旗下通义千问团队正式发布 Qwen 3.8-Max 预览版。这款总参数规模达 2.4 万亿的多模态大模型,被官方定位为"可能是除了 Fable 5 外最强大的模型"——直接对标当前业界最强的闭源基座。
预览版已率先上线阿里云 TokenPlan、Qoder、QoderWork 三大开发者平台,以及千问 PC 端和 Web 端。普通用户在千问客户端模型列表中勾选对应选项即可切换。这一接入节奏比预期更快——通常万亿参数模型从发布到全量可用会间隔数周。
一、2.4 万亿参数意味着什么
2.4 万亿(2.4T)参数是什么概念?作为对比,2020 年 GPT-3 的 1750 亿参数曾被视为"不可思议的巨大",Qwen 3.8-Max 的规模是 GPT-3 的近 14 倍。即便与 2025 年的 Qwen 2.5 Max 相比,3.8 版本也膨胀了近 3 倍。
但参数规模并非全部。Qwen 3.8 采用了 dynamic expert routing 加分层记忆缓存的混合架构,让 2.4T 参数真正"活起来"——不是堆出来的巨兽,而是按需激活的智能体。这正是 MoE 架构的价值:参数容量与计算量解耦,让万亿参数模型在推理时仍保持可控的算力开销。
图1:主流大模型参数规模演进(2018-2026)
二、开放权重的承诺与悬念
Qwen 团队延续了在开源方面的路径,承诺正式版将向开发者开放代码、模型权重及推理部署方案。这对开源社区是重大利好——目前能进入"万亿参数 + 开放权重"俱乐部的模型屈指可数。
但悬念仍在。截至预览版上线时,没有独立第三方基准(SWE-Bench Verified、LMSYS Arena Elo、GPQA、AIME)公布。"仅次于 Fable 5"的定位完全基于阿里内部评测,社区对此持谨慎态度。宣称的 100 万 token 上下文窗口出现在 Qwen Code 集成笔记中,但官方规格表尚未确认。架构细节、训练数据组成、知识截止日期均未披露——对于一个定位前沿的模型,这种透明度异常低。
三、开发者实测:能跑但不快
早期测试者反馈,预览版"功能可用但速度不快"——吞吐量在每秒 22-55 token 之间,明显慢于更小的生产级模型。对希望本地部署的开发者,等待仍在继续:在阿里发布更小的蒸馏版本或量化版本之前,Qwen 3.8 仍是云端专属。
社区最强烈的信号是:最有价值的发布将是一个能在普通硬件上运行的 27B 或 35B 蒸馏版本。参考 Kimi K3 将在 7 月 27 日开放权重,如果阿里紧随其后发布开放权重、基准测试或更小变体,开源前沿将显著推进。
四、万亿参数竞赛的下一周
Qwen 3.8 发布的时机极具戏剧性——正值 Kimi K3 因需求爆表暂停新订阅、OpenAI 静默缩减 Codex 上下文窗口的同周。中国开源大模型与海外闭源旗舰的正面交锋已经展开。Qwen 3.8-Max 的"2.4T 参数 + 开放权重"组合,配合阿里云的渠道分发能力,可能重塑开发者对"前沿模型必须闭源"的认知。
未来一周是关键:如果阿里兑现开放权重承诺,并提供独立基准验证"仅次于 Fable 5"的宣称,开源大模型格局将发生质变。如果只是 PPT 发布,Qwen 3.8 将被记住为一次精心定时的营销事件。
关联推荐
- Bonsai 27B:27B级AI模型首次在手机上运行 — 理解为什么"小而精"的蒸馏模型同样重要
- 康奈尔哈佛联合:AI 大模型分工合作效率飙升 2.6 倍 — 多模型协作是另一条扩展路径
- llama.cpp 合入 MTP:本地推理速度翻倍 — 开源推理优化的另一面
评论 (0)
加载评论中…