OC

Knowledge OS
GPT-5.6 Luna 降价 80%:OpenAI 不再只卖最强模型,而是争夺每一层推理预算
科技 · 2026-07-31 · AI 产业 · 阅读 1

GPT-5.6 Luna 降价 80%:OpenAI 不再只卖最强模型,而是争夺每一层推理预算

作者:陈墨|OC 产业与资本编辑

作者:陈墨|OC 产业与资本编辑

OpenAI 公告,GPT-5.6 系列在 7 月 30 日调整价格和服务层级:Luna 的 API 价格下降 80%,Terra 下降 20%,Sol 新增速度约为标准模式 2.5 倍的 Fast 处理方式。OpenAI 当前模型页面显示,Luna 调整后每百万输入 token 约 0.20 美元、输出 token 约 1.20 美元;Terra 约为 2 美元和 12 美元,具体仍应以实时价目表为准。

一句话结论:这次降价不是一次促销,而是 OpenAI 把同一家族拆成高吞吐、均衡和高能力三层,用路由和价格覆盖从分类任务到复杂 Agent 的完整预算。

过去模型公司习惯用最强基准成绩吸引注意力,但生产系统最常见的问题是“这个请求值不值得调用最贵模型”。内容分类、字段提取、审核初筛、搜索改写和短文本生成,通常不需要 Sol 级推理。若 Luna 足够便宜,开发者就可以把更多传统规则和小模型工作负载迁到统一 API。

Terra 扮演的是默认层:比旗舰便宜,能力又能覆盖大多数办公和编程任务。Sol Fast 则服务对延迟敏感、又不能牺牲复杂推理的场景。速度提升 2.5 倍通常意味着更高的调度优先级或额外价格,而不是免费获得更多算力。企业要比较的是每个成功任务的总成本,不是只看每百万 token。

应用路由器根据任务难度分配Luna、Terra和Sol

80% 的降幅还暴露了推理市场的价格压力。开放权重模型、专用推理芯片、缓存和量化持续压低边际成本,竞争对手也在用小模型争夺高频调用。模型能力差距缩小时,客户更容易按价格迁移,供应商必须不断把上一代能力下放到更便宜的层级。

这会改变应用架构。以前开发者可能选择一个模型处理所有请求;现在更合理的方案是先用 Luna 判断任务难度,再把少量高风险请求升级到 Terra 或 Sol,并对结果做验证。价格越分层,路由器、评测集、缓存和可观测性越重要。省下的钱不是来自“永远选最便宜”,而是来自“只在需要时选最贵”。

订阅版 ChatGPT 与 API 价格也不能混为一谈。API 按 token 与服务模式计费,ChatGPT 按套餐和使用限制提供访问。企业如果把网页订阅价格直接换算成生产成本,预算通常会失真。

关键事实

  • 来源:OpenAI 官方公告、模型文档和实时价目表
  • 涉及产品:GPT-5.6 Luna、Terra、Sol Fast
  • 核心变化:Luna 降价 80%,Terra 降价 20%,Sol Fast 速度约提升 2.5 倍
  • 生效时间:2026 年 7 月 30 日

OC 判断

模型战争正在从“谁最聪明”转向“谁能占据每一笔推理预算”。OpenAI 的优势是可以把同一平台的模型、工具调用和企业权限打包;风险是层级过多后,客户更容易看清昂贵模型并非每次都必要。真正的护城河会落在任务路由、可靠性和迁移成本上。

为什么重要

  • 对开发者:应建立分层评测集和自动路由,不要把降价简单当作替换模型的理由。
  • 对企业:预算需要同时计算输入、输出、缓存、Fast 模式和失败重试。
  • 对用户:更低推理成本可能让 AI 功能进入更多产品,但也会提高自动化调用频率。

参考来源

相关阅读

基于标题、摘要和正文内容自动匹配。

更多科技

评论

围绕这篇文章补充信息、提出问题或分享观察。

0
暂无评论。

发表评论