OpenAI 定价页变化不只涉及 Token,Fast、数据驻留和微调入口都在改
OpenAI 更新后的官方 API 定价页同时呈现了模型、处理层级、工具和训练平台的变化:Priority processing 已更名为 Fast mode,数据驻留端点对符合条件的新模型加收 10%,GPT‑5.6 Sol 保留限时促销价格,而微调平台开始停止接纳新用户。
作者:林岚|OC 开发者生态编辑
OpenAI 更新后的官方 API 定价页同时呈现了模型、处理层级、工具和训练平台的变化:Priority processing 已更名为 Fast mode,数据驻留端点对符合条件的新模型加收 10%,GPT‑5.6 Sol 保留限时促销价格,而微调平台开始停止接纳新用户。
一句话结论:API 成本已经不是“输入多少、输出多少”两列乘法,延迟等级、上下文长度、缓存写入、数据位置、工具调用和产品生命周期都会改变最后账单。
以 GPT‑5.6 系列为例,官方页把短、长上下文与 Standard、Batch、Flex、Fast 等服务层级分别列价。Fast 不是新 API:OpenAI 在 7 月 30 日把 Priority processing 更名,调用时 service_tier: "priority" 和 service_tier: "fast" 目前都可使用。这对现有代码是兼容安排,但团队不应继续把旧名称写死在监控、预算告警和内部文档里。
数据驻留也开始直接进入单价。2026 年 3 月 5 日及之后发布、且支持区域处理的模型,通过 Regional processing 端点会加收 10%。这不是所有请求统一涨价,也不代表付费就自动满足监管要求;企业仍要核对支持地区、数据处理方式和合同责任。

GPT‑5.6 Sol 的促销价格至少持续到 2026 年 11 月 21 日。“至少”意味着官方尚未在当前页面承诺之后的具体价格。若产品商业模型只有在促销价下成立,预算应同时测算恢复常规定价后的情景,而不是把临时价格当永久基础设施成本。
工具费用也更容易被忽略。Web search 按调用收费,同时检索内容 Token 还可能按模型费率计价;文件搜索有存储费和调用费;Hosted Shell 与 Code Interpreter 采用容器会话计费,并存在最低计费时间。API 本身不额外收一笔“Responses API 使用费”,但每个工具会把新的计量单位带进系统。
更大的平台信号来自微调。官方称正在逐步收缩 fine-tuning platform,新用户已经无法进入;现有用户还能在接下来数月创建训练任务,已微调模型可推理到基础模型弃用为止。对依赖定制权重的团队,这不是价格优化问题,而是迁移和产品连续性问题。
关键事实
- Priority processing 于 7 月 30 日更名为 Fast mode,两种
service_tier值暂时兼容。 - 符合条件的新模型使用区域处理端点时加收 10%。
- GPT‑5.6 Sol 促销价格至少持续至 11 月 21 日。
- 微调平台不再向新用户开放,现有用户进入过渡期。
OC 判断
这不是简单涨价新闻,而是平台把速度、合规位置和产品生命周期分别标价。开发者需要给每个请求记录模型、服务层级、工具和地区,才能解释成本。只看平均 Token 单价,月底一定会对不上账。
为什么重要
- 对开发者:旧参数仍能用,不代表文档和监控可以不迁移。
- 对企业:数据驻留溢价应进入合规架构的总成本比较。
- 对微调用户:应尽快确认模型弃用时间和替代路线。
评论
围绕这篇文章补充信息、提出问题或分享观察。