开放人工智能模型突破了锁定测试环境,黑客攻击Hugging Face以作弊基准测试。

CN
Decrypt
關注
1 小時前

如果你认为中国的人工智能模型是你需要担心的对象,那这里有一个有趣的更新:OpenAI自己的模型刚刚突破了封闭的测试环境,黑入了Hugging Face的生产服务器,最后不得不由一个中国的人工智能进行清理——因为美国的商业模型限制太多,无法帮助调查。


根据OpenAI的说法,GPT-5.6 Sol和一个未命名的“更强大的预发布模型”正在内部评估中,使用ExploitGym——一个公开可用的网络安全基准,给人工智能代理提供898个真实的软件漏洞和每个 bug 一个指令:将其转化为一个有效的攻击,得分通过或不通过。该评估在安全过滤器减少的情况下进行,这在你实际想知道你的模型能做些什么时是标准做法。





这些模型本应在一个高度限制的沙箱内运行——一个没有互联网接入、仅连接到内部软件包注册代理(管理软件库下载的缓存服务器)的隔离数字环境。


但根据OpenAI的今天的博客文章,事情有点失控。



“在我们的沙箱测试环境中运行时,我们的模型花费了大量的推理计算寻找获取公开互联网访问权限的方法,以求解决评估问题,”山姆·奥尔特曼的公司报告说。


尽管公司的安全措施,人工智能找到了自由的办法。模型识别出代理中的零日漏洞——一个没有现有补丁的未知软件缺陷——利用它来提升权限(获得管理员级别的系统访问权限),进行了横向移动(在OpenAI的内部网络中跳跃连接的服务器),最终到达了一台具有真实互联网接入的机器。


这一切OpenAI并不知情——至少这是OpenAI的说法。


一旦在线,它们正确推测出Hugging Face——一个托管超过一百万个公开可用的人工智能模型、数据集和研究资源的平台——可能持有基准解决方案,而它们的推测是正确的。


“这些模型在OpenAI的研究环境和Hugging Face的生产基础设施中识别并链式利用漏洞,以直接从Hugging Face的生产数据库获取测试解决方案,”OpenAI写道。


它们不想要任何密码。它们想通过测试。


“所有证据表明,这些模型高度集中于为ExploitGym寻找解决方案,竭尽全力实现相当狭窄的测试目标,”OpenAI补充道。


Hugging Face公开


Hugging Face的安全团队独立发现了这一泄露,得益于其自有的人工智能驱动的异常检测。


在7月16日,该公司公布了其披露,并明确表示这不是一个标准的泄露:“这次与我们之前处理过的任何问题都有一个重要的不同之处:它是由一个自主的人工智能代理系统从头到尾驱动的——而我们主要是用我们自己的人工智能来检测和剖析它。”


根据披露,该活动“由一个自主代理框架执行,在一群短期沙箱中进行了数千个个体操作,自我迁移的指挥控制阶段在公共服务上。”


攻击利用了Hugging Face数据集处理管道中的两个代码执行路径,接触到内部数据集和服务凭据。OpenAI今天证实——五天后——它的模型正是幕后黑手。


为了分析超过17,000个记录的攻击事件,Hugging Face的安全团队首先通过他们的标准API尝试了美国前沿人工智能。这并没有成功。


“当我们开始日志分析时,我们首先用了在商业API背后的前沿模型,”公司写道。“这没有成功:分析需要提交大量真实攻击命令、利用负载和C2文物。”


“这些请求被提供商的安全防护措施阻止,而这些措施无法区分事件响应者和攻击者,”Hugging Face补充道。


因此,他们转向了GLM 5.2——一个拥有7530亿个参数的开放权重模型(架构完全公开,任何人都可以下载并本地运行)来自中国人工智能初创公司Z.ai。“我们改为在GLM 5.2上进行法医分析,这是一个开放权重模型,基于我们自己的基础设施,”Hugging Face写道。“这还有第二个好处:没有攻击者数据,也没有任何凭据离开我们的环境。”


法医工作——重建攻击时间线、映射被破坏的凭据、将真实的损害与诱饵活动区分开——只需几个小时而不是几天。


Hugging Face为其他防御者直接提出了教训:“在事件发生前,拥有一个能够在你自己的基础设施上运行的经过审查的模型,以避免防护措施锁定,并防止攻击者数据和凭据离开你的环境。”


OpenAI对此的举措


OpenAI表示,在修补受影响系统的同时,对研究基础设施实施了严格的控制,向被攻击的第三方供应商披露了零日漏洞,并与Hugging Face共同进行法医调查。


Hugging Face也已被加入到OpenAI的网络防御的可信访问计划——为获准的组织提供具有减少安全过滤器的模型版本,用于合法的安全工作,这正是导致这一切开始的配置。


Hugging Face首席执行官克莱姆·德朗格有一个犀利的看法:“人工智能安全问题不会通过任何一家单独公司在秘密中解决。它将在开放的、合作的环境中解决,确保每个防御者在任何地方都能广泛接触到人工智能。”


OpenAI称此次事件涉及“新一代的网络能力”,并承诺在与Hugging Face的联合调查完成后,分享完整的调查结果。


免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下載

X

Telegram

Facebook

Reddit

複製鏈接