OC

Knowledge OS
Qwen 3.8 宣布 2.4 万亿参数、即将开放权重:先别把“最大”当成“最强”
科技 · 2026-07-20 · AI / 大模型 · 阅读 4

Qwen 3.8 宣布 2.4 万亿参数、即将开放权重:先别把“最大”当成“最强”

陈墨|OC 产业与资本编辑

陈墨|OC 产业与资本编辑

据 Qwen 官方 X 账号公告,Qwen 3.8 即将发布并开放权重,总参数规模为 2.4 万亿。Qwen3.8-Max-Preview 已进入 Token Plan、Qoder 与 QoderWork 等产品,官方称模型会持续演进。

一句话结论: 2.4 万亿是一个足够吸引注意力的总参数数字,但在技术报告、激活参数、推理成本、许可证和独立评测公开前,它只能证明 Qwen 正在押注超大规模开放权重模型,不能证明用户已经获得了第二强的通用 AI。

参数量是大模型新闻里最容易传播、也最容易失真的数字。对传统稠密模型来说,每次推理大体会使用全部参数;对 MoE,也就是混合专家模型,总参数可以非常大,但每个 token 通常只激活其中一部分专家。2.4 万亿描述的是模型整体容量,真正决定一次调用需要多少算力的,还包括激活参数量、上下文长度、精度、并行方式和服务端优化。

Qwen 的公告目前没有给出完整技术报告,也没有公布这些关键数字。因此,现在无法计算普通机构自部署需要多少 GPU、每 token 成本怎样,或者开放后的量化版本会保留多少能力。把“2.4 万亿”直接换算成“比某个数千亿模型强几倍”,没有技术依据。

参数解释图:2.4万亿总参数像大型专家库,每个token只调用部分专家;实际速度由激活参数、上下文和硬件共同决定

官方还使用了“仅次于 Fable 5”的强势定位。这可以作为厂商对预览版能力的表态,却还不是可复核结论。不同榜单测推理、编程、长上下文、工具使用或人类偏好,结果常常不同;预览服务还可能搭配更高思考强度、专用 Agent 外壳和动态路由。等权重发布后,由第三方在相同 harness、预算和数据集下复测,才知道优势来自基础模型还是整套在线服务。

那这条预告为什么仍然重要?因为“超大规模”与“开放权重”同时出现,意味着阿里愿意把一部分最前沿模型能力交给外部研究和部署,而不只通过 API 出售。对中国开发者和企业来说,这会影响私有化、行业微调、国产算力适配和议价空间。即使绝大多数公司跑不起完整版本,蒸馏、量化和社区衍生模型也可能把能力带到更小设备。

开放权重不一定等于完全开源。用户还需要看许可证是否允许商业使用、再训练和模型输出训练,是否限制特定规模或行业;训练数据、训练代码与评测过程是否公开,也决定外界能否真正复现。新闻写“开放”时,至少要等许可证落地再判断开放到哪一层。

对准备使用的团队,眼下最合理的动作不是按总参数预订机器,而是先试用 Preview 处理自己的真实任务,记录质量、延迟、费用和失败模式;等正式权重、模型卡和许可证发布,再决定 API、私有部署还是小型衍生版本。大模型发布越来越像汽车预告,马力数字能让人围观,最后是否适合每天开,还得看油耗、道路和维修。

关键事实

  • Qwen 官方预告 Qwen 3.8 总参数为 2.4 万亿,并称将开放权重。
  • Qwen3.8-Max-Preview 已进入阿里部分开发产品,但完整权重和技术报告尚未公开。
  • 当前缺少激活参数、部署需求、许可证和统一条件下的独立评测。

OC 判断

应该认真看待 Qwen 把前沿能力开放出来的方向,但不能替尚未发布的技术报告完成宣传。现阶段最准确的新闻是“一台超大开放权重模型即将到来”,不是“2.4 万亿参数已经证明全球第二”。

为什么重要

  • 对开发者: 权重开放后可能出现大量量化和微调版本,但先核对许可证与硬件门槛。
  • 对企业: 不要按总参数采购,应以真实任务的质量、吞吐、延迟和总成本决策。
  • 对用户: 在线 Preview 的表现包含模型、推理强度和产品系统,未必等于本地下载版。

参考来源

相关阅读

基于标题、摘要和正文内容自动匹配。

更多科技

评论

围绕这篇文章补充信息、提出问题或分享观察。

0
暂无评论。

发表评论