Strands Harness 开源,Agent 成本开始算到上下文管理这一层
据 Strands Agents 官方公告,项目推出开源 Strands Harness,把工具、会话和上下文管理等通用能力组合成可运行的 Agent 基础层。
作者:林岚|OC 开发者生态编辑
据 Strands Agents 官方公告,项目推出开源 Strands Harness,把工具、会话和上下文管理等通用能力组合成可运行的 Agent 基础层。
一句话结论:同一个模型的任务成本,也会受到外围执行框架怎样保存和传递信息的影响。
模型负责作出下一步判断,Harness 则处理它所处的工作环境:工具返回的大段内容是否全部塞回上下文,长会话怎样压缩,任务中断后怎样继续。名字看起来像基础设施,实际会直接出现在账单上。
官方称,在六项基准上使用相同 Claude、GPT 模型比较时,其方案以接近或相当的成绩实现约 28% 的 token 成本下降。这是项目方公布的基准结果,不能外推为任意模型、任意任务都节省相同比例。公告还表示更完整的基准论文将随后发布。

Strands 把部分较长工具输出移出即时上下文,并提供压缩和溢出恢复等机制。这类选择的合理性,要由任务能否找回关键证据来验证。少传文字确实可能减少开销,但若遗漏信息后模型又反复搜索,或者直接作出错误决定,成本会转移到重试和人工收尾上。
对准备引入它的团队,更有用的比较是同一组任务能否可靠完成、需要多少工具调用、失败后如何恢复,以及最终总费用。框架自带工具不代表这些工具应该获得生产权限;工具接入和授权仍需由部署方定义。
Apache 2.0 许可降低了试验门槛。它提供的是一个可检查、可替换的实现起点,而不是替企业完成可靠性证明。
关键事实
- 来源:Strands Agents 公告。
- 许可:Apache 2.0。
- 数字:约 28% 为厂商跨六项基准给出的 token 成本比较。
OC 判断
模型单价正在成为较容易比较的一项,执行框架的成本则更容易藏在重复上下文、失败重试与恢复过程里。选择 Harness 时,应把这些账一起打开,并保留退出和替换路径。
为什么重要
- 对开发者:用自己的真实任务比较完成率和重试次数。
- 对企业:不要把 token 下降直接视为总拥有成本下降。
- 对用户:更便宜的自动化仍应交付同等可核验结果。
评论
围绕这篇文章补充信息、提出问题或分享观察。