Opus 5.5 降价,40%的任务成本降幅并非所有 token 都便宜四成
Anthropic 在Opus 5.5 发布页宣布,新模型输入和输出价格分别为每百万 token 4美元、20美元,较 Opus 5 低20%;缓存读取为0.20美元,下降60%。公司另称,默认设置下典型任务总成本下降约40%。
作者:林岚|OC 开发者生态编辑
Anthropic 在Opus 5.5 发布页宣布,新模型输入和输出价格分别为每百万 token 4美元、20美元,较 Opus 5 低20%;缓存读取为0.20美元,下降60%。公司另称,默认设置下典型任务总成本下降约40%。
一句话结论:单价、缓存折扣与任务用量共同决定成本,厂商给出的总降幅不能直接套到每个应用。
三个降幅并不矛盾:输入、输出和缓存读取各有价格,一次任务又可能使用不同数量的 token。缓存占比较高的编码工作,与只有短提示的新会话,不会得到同样的节省。
发布页同时披露,部分生物与网络安全任务触发防护后会交给其他模型处理,基准脚注也说明了回退的存在。这意味着评测结果需要结合实际运行路径理解,不能一概视为单一模型在所有题目上的裸能力。

OC 认为,这次升级值得同时测试两件事:结果能否减少返工,回答是否更容易检查。文字更清楚有实际价值,但不能取代代码测试、事实来源与权限记录。把表达自然当成可靠性证明,容易让看起来合理的错误漏过审查。
团队若准备切换,宜保留同一批复杂任务的旧版结果,记录缓存命中、输出量、运行耗时和验收失败。测试也应覆盖模型拒绝或回退后的体验:用户是否知道任务状态,工作流是否能正确处理差异。
关键事实
- 价格:每百万输入4美元、输出20美元、缓存读取0.20美元。
- 40%口径:Anthropic 对默认设置下典型任务总成本的测算。
- 评测边界:发布方基准包含安全防护及部分模型回退,非独立复测。
OC 判断
降价最有意义的结果,是同一预算能够完成更多合格工作。厂商的平均数提供了测试理由,团队自己的任务分布才决定节省多少。采购时应把质量、延迟和失败处理放在同一张账上。
为什么重要
- 对开发者:分别记录缓存、输入、输出及重试开销。
- 对团队:核对任务中的安全回退行为,不把榜单分数当作所有工作流的保证。
评论
围绕这篇文章补充信息、提出问题或分享观察。