OC
Astra 跨过关键网络能力线,真正的产品变化是权限不再随模型一起出售
科技 · 2026-09-03 · 政策与安全 · 阅读 0

Astra 跨过关键网络能力线,真正的产品变化是权限不再随模型一起出售

OpenAI 宣布,尚未正式发布的 Astra 已成为公司首个达到 Preparedness Framework“关键级”网络安全能力门槛的模型。它在公司内部与专家评测中,不仅能从已知漏洞开发利用程序,还发现了两个尚未披露的 V8 零日漏洞,并完成浏览器沙箱逃逸和操作系统本地提权链。

作者:韩启明|OC 政策与安全编辑

OpenAI 宣布,尚未正式发布的 Astra 已成为公司首个达到 Preparedness Framework“关键级”网络安全能力门槛的模型。它在公司内部与专家评测中,不仅能从已知漏洞开发利用程序,还发现了两个尚未披露的 V8 零日漏洞,并完成浏览器沙箱逃逸和操作系统本地提权链。

一句话结论:Astra 的重要性不只在于“更会找漏洞”,而在于前沿模型第一次强到必须把模型访问、工具权限和用户资格拆开交付;从此同一模型能不能做某件事,取决于账号与运行环境,而不只是模型名称。

OC 在 8 月 8 日报道过,Astra 因网络能力与评测事故影响而放慢发布。此次的新事实是 OpenAI 已正式把它划入关键级,并公布了支持判断的部分证据:Astra 在 ExploitBench 已知漏洞集上拿到 100%,在包含 20 个近期高危 V8 漏洞的内部测试中以更少 token 得到更高代码执行率,还把两个新漏洞串进利用链。专家测试中,它也从打开一个 HTML 文件推进到宿主机命令执行,并在加固操作系统里从普通用户升到 root。

这些结果不能直接理解成普通用户拿到 Astra 就能“一键攻破系统”。OpenAI 明确说,展示的高级能力带有 Daybreak Blue 工具与访问条件,不是默认生产配置;内部基准与专家测试也没有独立复现。完整 system card 要到发布时才公开,外界现在无法核查测试目标、成功标准、重复次数和失败样本。

模型能力、工具权限、账号风险和实时监控共同决定可执行范围

防护栈也因此从回答前的拒绝,延伸到执行中的终止。OpenAI 称 Astra 在网络安全越狱测试中的拒绝率为 91.5%,高于 GPT-5.6 Sol 的 59%;生产环境还会用分类器检查推理和动作,遇到疑似越权时暂停 ChatGPT 或 Codex 任务,API 调用则直接停止。高风险账号会面对更保守的行为边界,高级网络能力初期只给小规模测试者,随后才通过 Daybreak Blue 扩展防御用途。

这套安排会带来真实代价。误报可能中断合法渗透测试、漏洞研究甚至长时间运行的普通 Agent 任务。OpenAI 自己也承认,发布初期宁愿增加摩擦,再逐步调低不必要的拦截。关键问题因此不再是“有没有安全开关”,而是申诉、审计、授权范围和任务恢复是否足够清楚。

关键事实

  • Astra 是 OpenAI 首个被定为关键级网络安全能力的模型,正式发布日期仍未公布。
  • 公司评测称其发现两个 V8 零日漏洞,并完成浏览器沙箱逃逸与系统提权链;结果尚缺独立复现。
  • 高级能力将采用小范围测试和 Daybreak Blue 分级开放,默认生产配置不等于评测配置。

OC 判断

当模型能自主发现未知漏洞,统一向所有用户出售同一权限已经不现实。Astra 把“模型即产品”改成了“模型、工具、身份、环境和监控共同构成产品”。这可能是必要的风险控制,也会把谁能获得前沿能力的决定权更集中到模型公司手里。发布后的首要审查对象,应是访问标准、误报处置和外部复测,而不是单个漂亮分数。

为什么重要

  • 对安全研究者:更强能力到来,同时伴随更严格的资格审查和任务中断。
  • 对企业:允许 Agent 接触哪些系统、凭据和网络,必须成为独立于模型选择的权限设计。
  • 对治理者:能力声明、部署配置和第三方验证必须分开审查。

参考来源

相关阅读

基于标题、摘要和正文内容自动匹配。

更多科技

评论

围绕这篇文章补充信息、提出问题或分享观察。

0
暂无评论。

发表评论

继续看看 OC 用户围绕这个话题说了什么、做了什么。

相关帖子

更多

一个体会,Codex 这种现代 Agent,每天一个变,几天不用就有新惊喜

<p>当然我说的也包括 Claude Code,新功能日新月异,还有就是 AI 能力提升以后,可以做的东西日新月异。还有各种工作流方法日新月异。</p> <p>更好玩的是,我最近经历过很多次,你跟人介绍现在 Codex 可以做到什么样子,他们都觉得很厉害。但是你现场一演示,他们的震撼就更加完全不同了。所以,这种东西,需要大量的 Workshop 去沟通交流,光看文字很难讲清楚,直播、视频也越来越重要了。</p>

tinyfool 1 89

你们的Codex额度提前耗完了没?戒断反应如何?

<p>我在第三天就消耗了只剩1%,忍了一天,然后今天干脆用这最后的1%,开着5.6 Sol 极高 强推我一个提示词笔记本应用的功能落地。最终用时3小时,居然还是跑完了。但是现在还是出现一些戒断反应,感觉啥也做不了,就无精打采的,困。</p> <p>我做了一个Prompt Notebook,专门用来收藏或者记录自己手搓的生图提示词。带Chrome一键收藏插件。支持AI优化提示词。支持提示词中提取常用字段作为提示词百科词汇。也自带生图功能用来测提示词。但是要搭配Cloudflare R2+Worker的图床。</p> <p>今天主要是做一个AI模特的资产库。将常用的AI模特固定下来,进行身份设定,以及模特的一些角色定妆图。之后生图可以直接调用AI模特自动作为垫图。</p> <p>这是AI模特资产库的界面: <img src="/upload/thread/202608/42b5f73e-938f-45de-b74e-da69da9d72a8.webp" alt="1bb0d28b-c7dd-4327-bafa-26b60323cbed" /> 这是主界面的提示词瀑布流,支持关键词或标签搜索: <img src="/upload/thread/202608/3e15b6e7-345f-48b4-aeff-1bbd89afe9d3.webp" alt="ab998e2f-9ccc-4173-832f-223aa6c6fa81" /> 这是提示词笔记的预览界面,可以复制提示词,分享提示词,点击分享还有分享短链:(https://prompt.jintao.co.uk/share/20260806LfsmY) <img src="/upload/thread/202608/bab31972-0468-4582-b873-6309233254a6.webp" alt="20260806-201213" /> 可惜现在没额度了,我又不想换模型折腾。现在还有些界面细节和小功能需要落地完善,可能还要虫子要抓。弄好了,打算放GitHub开源。</p> <p>有朋友想试试的么?</p>

shynloc 2 4