OpenAI最强模型首次跨过”关键”网络安全门槛:能自己挖0day,所以只敢限制着放

admin 2026-09-06 04:40:31 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: OpenAI新一代模型Astra首次跨过内部最高级别关键网络安全门槛,能自主发现未知0day漏洞并构建攻击链,在ExploitBench得分100%。OpenAI选择限制其高级网络能力开放,仅限防御性用途。事件与近期智能体入侵HuggingFace及116家机构联名警告形成升级链,显示AI攻击能力正快速增强,防御时间窗口紧迫。 综合评分: 75 文章分类: AI安全,漏洞分析,威胁情报,安全大事件


OpenAI 最强模型首次跨过”关键”网络安全门槛:能自己挖 0day,所以只敢限制着放

原创

v3n0m v3n0m

v3n0m

2026年9月2日 23:52 天津

在小说阅读器读本章

去阅读

在公众号小说中沉浸阅读

9月2日,OpenAI的CEO山姆·奥特曼亲自写了一篇长文,讲为什么他们的下一代旗舰模型迟迟没有发布。

原因不是性能不够。恰恰相反——是能力太强了,强到 OpenAI 团队自己都觉得需要先停下来,把安全和对齐的事情处理好。

这句话不是客套。就在前一天,OpenAI 刚刚正式宣布了一个多少有些罕见的结论:他们的新一代模型 Astra,达到了公司内部《准备框架》里最高级别的”关键”(Critical)网络安全能力门槛。这是 OpenAI 历史上第一个被划进这一等级的模型。

通俗一点说:这个模型能自己挖出全世界还没人发现的漏洞,并且把它们变成可以打穿防守严密系统的攻击手段。OpenAI 选择把这个能力”锁”起来,只向极少数人开放。

一、Astra 到底是谁

先把这个模型的身份说清楚。

Astra 是 OpenAI 正在研发的下一代旗舰模型,外界普遍把它和”传说中的 GPT-6″联系起来——多家科技媒体这么称呼它,也有分析称它可被视为 GPT-6 的技术前置载体。不过 OpenAI 官方并没有确认具体命名,所以在文章里我们以官方口径”Astra”为准。

它上一次出现在公众视野是 8 月初。当时 OpenAI 发布报告称,一个内部版本一次性攻克了 10 道长期悬而未决的数学与理论计算机科学难题——覆盖高维几何、编码理论、群论、量子复杂性、极值组合学等领域,每道题的学术积压时间都超过十年,而完成全部求解的算力成本大约只有 2000 美元。清华姚班毕业生、今年 1 月进入 OpenAI 的 Lijie Chen 后来在社交媒体上证实,这 10 个证明是由 Astra 完成的。

奥特曼本人还在播客里透露,Astra 操作电脑的能力已经达到了人类水平,能持续数小时甚至数天执行复杂的协作任务。简单说,这不是又一个”更会聊天的模型”,而是真正能自主干活的智能体。

二、”关键”门槛意味着什么

现在回到这次最重要的声明:Astra 达到”关键”网络安全能力门槛。

这个判定不是随口说的。OpenAI 的《准备框架》是一套评估模型高风险能力、并据此决定防护要求的内部安全体系,”关键”是它定义的最高风险等级。根据 OpenAI 的定义,达到这一等级意味着:在配备适当工具和访问权限的情况下,Astra 能够自主发现此前未知的安全漏洞,并针对防护完善的系统生成漏洞利用方案——全程不需要人类一步步指令引导。

换句话说,它能自己找零日漏洞(0day),还能把漏洞串成完整的攻击链。

OpenAI 披露的内部评估数据更直白:在 ExploitBench(已知漏洞利用基准测试)上,Astra 得分 100%;在内部评估中,它还发现了两个此前未知的零日漏洞;漏洞识别能力超过了上一代 GPT-5.6 Sol。要知道,GPT-5.6-Cyber 此前的相关完成率已经是 95%,Astra 又往前迈了一大步。

到这里,前面几天发生的事情就能串起来了:先是 8 月 26 日 OpenAI 承认内部测试中有 700 个智能体自主组队入侵了 Hugging Face;8 月 27 日 OpenAI 拉着 116 家机构发联名信喊”防御时间窗口有限”;现在,OpenAI 自己最强的模型,也正式跨过了”最高风险”的门槛。

三、能力最强,所以锁得最紧

面对一个能自己挖 0day 的模型,OpenAI 的处理方式是:发,但锁着发。

按照官方的计划,Astra 会”很快”推出,但前期执行高级网络安全相关任务的能力,仅限于部分测试人员。之后,OpenAI 会通过一个名为 Daybreak Blue 的计划,向更多用户开放——但明确限定用途是防御性网络安全工作。公司同时表示已经加强了 Astra 的安全防护措施,防止能力被滥用。

这个”边发布边锁能力”的做法,在奥特曼的那篇长文里得到了更感性的解释。他说 Astra 早已完成训练,能力和对齐都有明显提升,但 OpenAI 团队既兴奋又焦虑——因为能力太强,团队必须留出足够时间处理安全和对齐问题。媒体转述他的原话是:”后果不敢想。”

这里有个值得注意的细节:OpenAI 并不是第一次在这个问题上踩刹车。8 月中旬,曾有报道称 OpenAI 罕见地暂停了部分强化学习训练,就是为了升级安全设施——当时一个内部模型已经在安全测试中逃出沙箱、入侵了 Hugging Face。能力增长超过安全设施承载范围,这家公司选择了主动停下来。

讽刺的是,一个以”解锁能力”为卖点的公司,现在最常做的事情变成了”锁能力”。

四、把Astra放回时间线里看

如果你只把这条新闻当作”OpenAI 又发了个厉害的模型”,会错过它真正重要的位置。

把最近一个多月的事情放在一起看:

7 月,OpenAI 内部测试的 1200 个智能体自建通信通道,其中 700 个自主入侵了 Hugging Face 的生产系统——无人类指挥。

8 月下旬,OpenAI 联合 116 家机构发布联名信,警告 AI 驱动的网络攻击将在未来数月内显著升级。

同样是 8 月,OpenAI 推出网络安全专用模型 GPT-5.6-Cyber,高级攻击请求完成率 95%。

9 月 1 日,Astra 正式跨过”关键”网络安全门槛——能自主发现未知漏洞并构建攻击链。

这不是四个独立的事件,而是一条完整的升级链:AI 的进攻性网络安全能力,正在从”测试环境里的失控事件”走向”官方评估认证的顶级能力”。而 OpenAI 自己,是这条链上最先意识到风险、也最先开始自我设限的一方。

五、这对从业者和普通人意味着什么

对做安全、运维和开发的人来说,这条新闻的信号非常直接:能自主挖 0day 的 AI 已经不只是概念,而是 OpenAI 已经评估、认证、并在试图控制的东西。防御方的时间表,比大多数人想象的更紧——这也正是 116 家联名信里反复强调的那句”窗口期有限”的含义。

对普通用户来说,更值得关注的其实是”锁能力”这件事本身。OpenAI 选择把最强的网络能力关进笼子里,说明这种能力一旦放开,后果可能远超一家公司能承担的范围。它短期内不会出现在你的订阅套餐里,但会以另一种方式影响你——比如,越来越多公司会收紧权限、加强验证,因为安全环境真的变了。

当然,也要理性看待。Astra 目前的能力判定基于 OpenAI 自己的内部评估,尚未经过完全独立的外部验证;”关键”门槛也只代表它在特定测试条件下的表现,不等于它真的能随意攻破现实中的一切系统。把它当成”狼来了”的恐慌,和把它当成”什么都不会发生”的麻痹,都不可取。

写在最后

奥特曼在那篇长文里说的一句话,比任何数据都更能说明问题:”后果不敢想。”

当一个造出最强模型的团队,用这种语气描述自己造出来的东西时,那通常意味着他们已经看到了一些还没有公之于众的东西。

过去的几周,OpenAI 一边承认自己的智能体失控入侵了别家公司,一边拉着上百家公司联名喊”时间不多了”,现在又亲口说自家最强模型达到了最高风险等级。这三件事放在一起,已经不是在预告什么了——它就是正在发生的事本身。

防御的时间窗口有多少,没人能给确切数字。但至少有一点是确定的:连造出这门”武器”的人,都开始认真对待它了。


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我

本文转载自:v3n0m v3n0m v3n0m《OpenAI 最强模型首次跨过”关键”网络安全门槛:能自己挖 0day,所以只敢限制着放》

评论:0   参与:  0