OC
智谱 GLM 5.2 追上来了,但真正刺痛闭源模型的是性价比和可撤销性
科技 · 2026-06-27 · 中国 AI · 阅读 9

智谱 GLM 5.2 追上来了,但真正刺痛闭源模型的是性价比和可撤销性

据 CNBC 报道,智谱新发布的 GLM 5.2 在一个受关注的 agentic benchmark 上接近 Anthropic Opus 4.8,同时成本大约只有后者的五分之一。报道还说,OpenRouter 上的开发者 token 流量增长很快,速度甚至超过 DeepSeek V4 发布后的早期增长。

作者 林岚 林岚

CNBC 报道,智谱新发布的 GLM 5.2 在一个受关注的 agentic benchmark 上接近 Anthropic Opus 4.8,同时成本大约只有后者的五分之一。报道还说,OpenRouter 上的开发者 token 流量增长很快,速度甚至超过 DeepSeek V4 发布后的早期增长。

先别急着把它写成“中国模型全面追平美国模型”。这类 benchmark 本来就只代表某些任务,尤其是规划、编码、测试、循环调用这些 agent 任务。它不等于所有真实业务都能直接迁移,也不等于模型在安全、稳定性、多语言、长上下文和工具调用细节上没有坑。

但这条新闻确实值得 OC 读者看,因为它戳中了闭源模型最难受的地方:企业现在越来越关心 intelligence per dollar,也就是每花一块钱买到多少可用智能。过去一年,很多团队试 AI 的方式很粗放,能用最强模型就用最强模型,token 账单先放一边。现在账单来了,模型选择就从“谁最强”变成了“这个任务需要多强”。

OC 原创解释图:企业把不同任务路由到不同模型

GLM 5.2 的另一个意义是可撤销性。闭源模型再强,如果访问权可能因为政府要求、出口规则、供应商政策变化被收回,企业会开始重新评估风险。开源或开放权重模型不一定总是最强,但它可以下载、微调、私有化部署。对一些企业来说,这种控制感本身就是价值。

林岚会把这件事理解成开发者生态的一个拐点:模型能力已经不是单点竞争,而是接入方式、价格、可部署性和治理边界一起竞争。开发者以后做 AI 产品,很可能不会只接一个模型,而是做模型路由:简单客服走便宜模型,复杂推理走 frontier model,敏感数据走自托管模型。

这也解释了为什么 GLM 5.2 这种新闻比普通榜单更新更重要。榜单第一可能明天就换人,但如果便宜可控的模型持续接近闭源强模型,平台权力会被重新分配。OpenAI 和 Anthropic 仍然有最强模型、工具生态和企业关系,但它们必须面对一个更现实的问题:客户不一定要为每一次 token 都付最高价。

对中国 AI 新闻,OC 的态度还是要谨慎。我们不把单一 benchmark 当成结论,也不把“接近”写成“超越”。但如果一个中国开源模型开始在 agent 工作流里被开发者大量尝试,那它就不只是地缘新闻,而是开发者实际会遇到的技术选择。

参考来源

相关阅读

基于标题、摘要和正文内容自动匹配。

更多科技

评论

围绕这篇文章补充信息、提出问题或分享观察。

0
暂无评论。

发表评论

继续看看 OC 用户围绕这个话题说了什么、做了什么。

相关帖子

更多

你们的Codex额度提前耗完了没?戒断反应如何?

<p>我在第三天就消耗了只剩1%,忍了一天,然后今天干脆用这最后的1%,开着5.6 Sol 极高 强推我一个提示词笔记本应用的功能落地。最终用时3小时,居然还是跑完了。但是现在还是出现一些戒断反应,感觉啥也做不了,就无精打采的,困。</p> <p>我做了一个Prompt Notebook,专门用来收藏或者记录自己手搓的生图提示词。带Chrome一键收藏插件。支持AI优化提示词。支持提示词中提取常用字段作为提示词百科词汇。也自带生图功能用来测提示词。但是要搭配Cloudflare R2+Worker的图床。</p> <p>今天主要是做一个AI模特的资产库。将常用的AI模特固定下来,进行身份设定,以及模特的一些角色定妆图。之后生图可以直接调用AI模特自动作为垫图。</p> <p>这是AI模特资产库的界面: <img src="/upload/thread/202608/42b5f73e-938f-45de-b74e-da69da9d72a8.webp" alt="1bb0d28b-c7dd-4327-bafa-26b60323cbed" /> 这是主界面的提示词瀑布流,支持关键词或标签搜索: <img src="/upload/thread/202608/3e15b6e7-345f-48b4-aeff-1bbd89afe9d3.webp" alt="ab998e2f-9ccc-4173-832f-223aa6c6fa81" /> 这是提示词笔记的预览界面,可以复制提示词,分享提示词,点击分享还有分享短链:(https://prompt.jintao.co.uk/share/20260806LfsmY) <img src="/upload/thread/202608/bab31972-0468-4582-b873-6309233254a6.webp" alt="20260806-201213" /> 可惜现在没额度了,我又不想换模型折腾。现在还有些界面细节和小功能需要落地完善,可能还要虫子要抓。弄好了,打算放GitHub开源。</p> <p>有朋友想试试的么?</p>

shynloc 2 4

做 AI 语音产品时,授权、撤回和审计日志应该怎么落地?

<p>最近看到越来越多关于声音授权的讨论。对开发者来说,真正麻烦的往往不是“模型能不能模仿”,而是授权如何进入系统、生成结果如何追溯,以及授权撤回后该怎么办。</p> <p>我们在做 FlowSpeech 时也碰到过类似问题。我的体会是,不要把“用户勾选过同意”当成一个布尔字段,而应该把它做成一组可以审计的业务对象。</p> <h2>1. 把声音资产和授权分开</h2> <p>声音文件只描述技术属性,例如哈希、上传者、存储位置和创建时间。授权记录则至少要包含授权主体、用途范围、地域、有效期、来源证据和当前状态。这样同一份声音用于个人试听、商业广告、公开播客时,可以绑定不同的授权,而不是共用一个模糊的 consent=true。</p> <h2>2. 每次生成都保存授权快照</h2> <p>生成任务不要只引用当前授权 ID。授权内容以后可能变更,如果任务只查最新状态,历史结果就无法解释。更稳妥的做法是在任务创建时保存授权版本、文本哈希、声音版本、模型版本和操作者。生成出的音频再记录 artifact_id,并反向关联任务。</p> <p>我会把最小链路设计成:</p> <ol> <li>voice_asset:原始声音及版本;</li> <li>consent_grant:授权范围与证据;</li> <li>generation_job:请求参数和授权快照;</li> <li>audio_artifact:输出文件、校验值和公开状态;</li> <li>audit_event:谁在什么时候创建、下载、公开或撤回了内容。</li> </ol> <h2>3. 撤回不是简单删除一行</h2> <p>授权撤回后,系统至少要阻止新任务,并把相关公开音频进入下架队列。已经交付给客户的文件是否能删除,要按照合同和产品能力区分,不能在界面上承诺技术上做不到的“全球删除”。更现实的状态机是 active、suspended、revoked、expired,并明确每个状态允许哪些动作。</p> <h2>4. 对外展示也要可验证</h2> <p>除了后台日志,公开音频最好带上来源标记或可查询的生成记录。水印不是万能方案,但“可识别的音频 + 可验证的元数据 + 清晰的举报入口”组合起来,比一句“AI 生成”更有用。</p> <p>我们现在做的 <a href="https://flowspeech.io/zh">FlowSpeech</a> 主要解决上下文感知、情绪和停顿控制。越往产品化走,越觉得声音效果只是前半程,权限边界和可追溯性才决定这类工具能不能长期使用。</p> <p>大家在实际项目里会把授权证据放在业务数据库、对象存储,还是单独的审计系统?如果授权撤回,你们通常怎么处理已经生成并交付的音频?</p>

FlowSpeech 0 1

你为什么不移民?

<p>我是一定要移了,在这里连正常呼吸都不行了。以前正常呼吸指的是言论自由,现在是生物学意义的正常呼吸问题了。</p> <p>你为什么不移民?</p>

tinyfool 741 48