Qwen 3.8 宣布 2.4 万亿参数、即将开放权重:先别把“最大”当成“最强”
陈墨|OC 产业与资本编辑
陈墨|OC 产业与资本编辑
据 Qwen 官方 X 账号公告,Qwen 3.8 即将发布并开放权重,总参数规模为 2.4 万亿。Qwen3.8-Max-Preview 已进入 Token Plan、Qoder 与 QoderWork 等产品,官方称模型会持续演进。
一句话结论: 2.4 万亿是一个足够吸引注意力的总参数数字,但在技术报告、激活参数、推理成本、许可证和独立评测公开前,它只能证明 Qwen 正在押注超大规模开放权重模型,不能证明用户已经获得了第二强的通用 AI。
参数量是大模型新闻里最容易传播、也最容易失真的数字。对传统稠密模型来说,每次推理大体会使用全部参数;对 MoE,也就是混合专家模型,总参数可以非常大,但每个 token 通常只激活其中一部分专家。2.4 万亿描述的是模型整体容量,真正决定一次调用需要多少算力的,还包括激活参数量、上下文长度、精度、并行方式和服务端优化。
Qwen 的公告目前没有给出完整技术报告,也没有公布这些关键数字。因此,现在无法计算普通机构自部署需要多少 GPU、每 token 成本怎样,或者开放后的量化版本会保留多少能力。把“2.4 万亿”直接换算成“比某个数千亿模型强几倍”,没有技术依据。

官方还使用了“仅次于 Fable 5”的强势定位。这可以作为厂商对预览版能力的表态,却还不是可复核结论。不同榜单测推理、编程、长上下文、工具使用或人类偏好,结果常常不同;预览服务还可能搭配更高思考强度、专用 Agent 外壳和动态路由。等权重发布后,由第三方在相同 harness、预算和数据集下复测,才知道优势来自基础模型还是整套在线服务。
那这条预告为什么仍然重要?因为“超大规模”与“开放权重”同时出现,意味着阿里愿意把一部分最前沿模型能力交给外部研究和部署,而不只通过 API 出售。对中国开发者和企业来说,这会影响私有化、行业微调、国产算力适配和议价空间。即使绝大多数公司跑不起完整版本,蒸馏、量化和社区衍生模型也可能把能力带到更小设备。
开放权重不一定等于完全开源。用户还需要看许可证是否允许商业使用、再训练和模型输出训练,是否限制特定规模或行业;训练数据、训练代码与评测过程是否公开,也决定外界能否真正复现。新闻写“开放”时,至少要等许可证落地再判断开放到哪一层。
对准备使用的团队,眼下最合理的动作不是按总参数预订机器,而是先试用 Preview 处理自己的真实任务,记录质量、延迟、费用和失败模式;等正式权重、模型卡和许可证发布,再决定 API、私有部署还是小型衍生版本。大模型发布越来越像汽车预告,马力数字能让人围观,最后是否适合每天开,还得看油耗、道路和维修。
关键事实
- Qwen 官方预告 Qwen 3.8 总参数为 2.4 万亿,并称将开放权重。
- Qwen3.8-Max-Preview 已进入阿里部分开发产品,但完整权重和技术报告尚未公开。
- 当前缺少激活参数、部署需求、许可证和统一条件下的独立评测。
OC 判断
应该认真看待 Qwen 把前沿能力开放出来的方向,但不能替尚未发布的技术报告完成宣传。现阶段最准确的新闻是“一台超大开放权重模型即将到来”,不是“2.4 万亿参数已经证明全球第二”。
为什么重要
- 对开发者: 权重开放后可能出现大量量化和微调版本,但先核对许可证与硬件门槛。
- 对企业: 不要按总参数采购,应以真实任务的质量、吞吐、延迟和总成本决策。
- 对用户: 在线 Preview 的表现包含模型、推理强度和产品系统,未必等于本地下载版。
评论
围绕这篇文章补充信息、提出问题或分享观察。