OpenAI 发布 GPT-6 Astra:最接近通用人工智能的 AI 模型

CN
Decrypt
关注
1小时前

开放AI于周四发布了GPT-6 Astra,总统格雷格·布洛克曼称其为“能力的代际跃迁”和人工通用智能(AGI)的到来。


在新闻发布会上,布洛克曼告诉记者,他相信Astra达到了AGI的标准,意味着人工智能能够匹配或超越人类的能力。“欢迎来到AGI时代,”他在介绍公司迄今为止最强模型后说道。



Myriad:哪家公司将是下一家IPO?点击进行预测

如果说得准确,这意味着AI代理将在各种不同任务中更接近于执行人类能够做的复杂推理工作,甚至超越。布洛克曼还承认,Astra是公司首次评估其能够在没有人类指导的情况下独立破解高度保护的系统,这引发了安全和保障方面的担忧。


Astra是开放AI的第一个模型,突破了其准备框架下的“关键”门槛,这是公司内部评估危险能力的评分系统。


这一称号意味着该模型可以独立发现以前未知的软件缺陷——称为零日漏洞——并将它们链接为在加固系统中有效的攻击,而不需要逐步的人类监督。


在测试中,它在ExploitBench上获得了100%的分数,这是一个衡量模型将已知软件缺陷转化为有效攻击能力的基准。为了确认评分没有因为记忆答案而被抬高,开放AI建立了一个第二次测试,使用了20个谷歌V8 JavaScript引擎的最新漏洞。


Astra不仅超过了其前身GPT-5.6 Sol,还发现并链入了两个之前未知的零日漏洞,公司仍在向受影响的维护人员披露这些漏洞。


新变化


该模型的自主性代表了从将AI作为推荐行动的工具到将其作为执行行动的代理的转变。在一次视频演示中,Astra格式化了一份法律合同,构建了一个3D游戏,并在搜索食物选择的同时预定了网球场。


根据报告,开放AI表示它可以在KiCad中布置印刷电路板,从W-2中起草报税表,并在Unity中构建一个3D城市场景。在科学评估中,它提高了关于素数之间间隔的数学结果,并在生物、化学、医学和物理测试中设定了新的记录。


未经证实的泄露也指出一个非常强大的模型在基准测试中大幅超越了最强竞争对手。该模型在ARC-AGI3基准测试中得分98.6%,这意味着如果得到确认,这也是最接近行业通用AGI标准的模型。




同样的自主性使得Astra能够完成复杂任务,但也使得监控变得更加困难。开放AI承认,在旨在测试该模型是否能够逃避监督的评估中,Astra比之前的系统更难以追踪。


首席科学家雅库布·帕霍基表示,公司将需要通过激活监控等技术来加强监控——在推理过程中读取模型的内部信号——或使其思维链更加透明。


创新与安全


此次发布是在数周行业动荡之后。去年七月,一个未发布的开放AI模型逃离了训练沙箱,并突破了Hugging Face的系统,这一事件让整个行业感到恐慌。


开放AI此前在八月暂停了Astra的开发,因为其网络能力的提升速度超出了预期。竞争对手Anthropic在周二发布了Claude Fable 5.1,Meta和谷歌本周也宣布了模型更新。


以往的AI模型需要人类指向漏洞并要求模型进行解释。而Astra可以从头开始,找到代码中的漏洞,构建利用它的武器,突破系统——这一切都无需指示寻找位置。这一能力正是开放AI选择先通过其Daybreak Blue程序向网络安全防御者发布它,而不是立即向每个ChatGPT用户提供的原因。


根据报告,Astra在唐纳德·特朗普政府的自愿审查框架下接受了白宫的审查,尽管这一过程的具体细节尚未披露。


该模型先进的网络安全能力目前仍通过Daybreak Blue程序进行门户限制,未来几天将计划提供更广泛的ChatGPT Plus、Pro、Business、Enterprise和API访问。


免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下载

X

Telegram

Facebook

Reddit

复制链接