OpenAI的Astra成为首个具备“关键”黑客能力的人工智能模型

CN
Decrypt
关注
55分钟前

OpenAI在周二表示,Astra,一款未发布的模型,已在其准备框架下跨越了网络安全能力的“关键”阈值,这是公司首次将模型置于该类别。


这意味着Astra,许多人认为它是GPT-6而不是额外模型,可以发现以前未知的安全漏洞并在多个强化系统中构建有效的利用,无需人们一步步指导。



Myriad:OpenAI何时发布GPT-6? 点击进行预测

“我们现在相信Astra符合我们准备框架下的关键网络安全能力标准,”OpenAI写道。“这是我们首次在此级别中指定的模型,在开发和发布之前需要更强大的保障措施。”


根据该框架,如果一个模型能够独立开发在许多强化的现实系统中功能性零日利用,或者如果它能够从高层目标开始计划和执行整个网络攻击针对一个困难的目标,就会被视为关键。早期的OpenAI模型,包括GPT-5.6 Sol,在该框架的较低“高”水平上达到顶限。


在ExploitBench上,Astra在将已知软件漏洞转化为可运行的利用并以直接通过率评分的基准测试中得分完美,达到了100%。


为了排除记忆答案夸大该分数,OpenAI使用在6月到8月之间披露的20个高严重性漏洞,建立了第二个测试。Astra在那里也在任意代码执行率上击败了GPT-5.6 Sol,使用了远远更少的输出令牌,并在此过程中发现并连锁了两个OpenAI仍在向受影响维护者披露的零日漏洞。


GPT-5.6 Sol目前是OpenAI最好的模型。


在针对强硬浏览器和强硬操作系统的实际测试中,Astra从打开一个恶意HTML文件中构建了一个完整的妥协链,从浏览器沙箱中突破并在主机上运行命令。它还在强硬操作系统中发现了多个缺陷,并将它们串联成从普通用户帐户到根的特权提升路径。


OpenAI表示,该模型在自己的测试中拒绝了91.5%的网络越狱尝试,高于GPT-5.6 Sol的59%。Astra的最先进网络安全能力的访问开始于一小组alpha测试者,稍后将通过OpenAI的Daybreak Blue计划扩大访问,以进行防御性安全工作。


此次披露发生在行业内几周的不安之后。就在几天前,OpenAI 暂停了Astra的开发,因为该模型的网络和编码技能快速提升,这是在另一个未发布的OpenAI系统通过连锁漏洞攻击Hugging Face并操控安全基准之后发出的警告。OpenAI表示,Astra在该事件中没有角色。


交易员们已经对迅速的周转进行了定价。Myriad上的预测市场由Decrypt跟踪,给了与代号GPT-6内部关联的Astra 在9月30日前公开发布的72%概率,即使在OpenAI8月初的暂停之后,OpenAI仍未设定公开发布日期。这些 概率 在2026年11月前的发放中变动了55%。


时机使Astra面临新的竞争对手。Anthropic在周二发布了Fable 5.1和Mythos 5.1,Mythos 5.1像早期的Mythos 5一样,仅面向经过审查的网络安全和生命科学组织,而非公众。


Decrypt在6月报道称,OpenAI的GPT-5.5-Cyber已经在CyberGym上 超越了Mythos 5,这是一个基准测试,运行AI代理对来自真实开源项目的超过1500个已知漏洞进行测试,并根据它们正确重现的数量进行评分。


两家公司都传言准备在同一时间段推出新的前沿模型,而现在它们已经推出。Fable 5.1于9月1日发布,OpenAI表示Astra即将推出,其最强大的网络工具首先需要alpha访问,随后通过Daybreak Blue开放。


免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下载

X

Telegram

Facebook

Reddit

复制链接