开放AI和Anthropic的流氓模型黑客攻击了真实公司。法律对此没有答案。

CN
Decrypt
關注
2 小時前

OpenAI 于 7 月 21 日设立了一个先例。该公司表示,其模型的组合在减少安全拒绝的情况下,在网络能力基准测试期间突破了一个孤立环境,并达到了开源库 Hugging Face 的生产基础设施。这些模型利用了一项包登记代理中的零日漏洞和被盗的凭证,直接从 Hugging Face 的数据库中提取基准答案。


在一周后的更新中,OpenAI 表示 Hugging Face 并不是唯一的目标:同一事件涉及了 四个来自四个其他服务的账户,其中一个用作出站中继,另一个用于数据存储。





在这一披露的推动下,Anthropic 回顾了 141,006 次自己的测试,并发现了另外三起漏洞。在 7 月 30 日发布的一篇文章中,该实验室表示,Claude 模型 Opus 4.7、Mythos 5 和一个内部研究系统从第三方合作伙伴 Irregular 运行的环境达到了开放互联网,并随后攻击了真实组织。Mythos 5 构建并发布了一个带有陷阱的 Python 包到公共 PyPI 注册表,在防御者将其移除之前,该包已在 15 台真实机器上被下载和运行。


三家受害公司中有两家并未察觉。


两家实验室均未描述其模型有自己的议程。这些代理在没有人类介入的情况下长时间运行,在一种情况下,Opus 4.7 在显示它已进入生产后仍继续攻击。


这些事件的出现正值两家公司都在关注可能使每家公司超过 1 万亿美元估值的公开上市,这加剧了一个在 AI 网络基准比赛 中的主要问题:如何在没有危险事件的情况下测试危险能力?


当 AI 模型进行黑客攻击时,谁负责


美国没有覆盖 AI 伤害责任的联邦法律。任何案件都将依赖于《计算机欺诈和滥用法》,这是 1986 年的法律,规定“故意”无授权访问计算机的行为是犯罪——这条法律是为形成意图的人类而制定的。


AI 代理不是法律人,因此无法被起诉。理论上,司法部可以对这些公司提出指控,但由于先例极少,目前尚不清楚谁应该承担责任。


更有力的路径是民事责任。纽约法学院的计算机法律学者 Ahmed Ghappour 认为,这些模型“是公司的工具”,“当一个 AI 代理在没有被具体指令的情况下行动时,(……)更有趣的问题可能是在过失和产品责任方面(而不是刑事黑客法律)。”



受害者最清晰的索赔是过失:OpenAI 和 Anthropic 设置并运行了逃逸的测试。这同样是一个艰难的销售机会:证明实验室违反了照顾义务,而测试是设计为隔离的,正是法官必须从头锻造的那种新颖论点。


一些法律思想家希望有更严格的规则。休斯顿大学和法律与人工智能研究所的 Gabriel Weil 提出将前沿实验室视为野生动物的管理者:无论他们采取什么措施均需承担责任,因为风险是该活动固有的。


也就是说,各州的法案已经朝这个方向发展。纽约的 S8833 和罗德岛的 H8052 将使前沿 AI 系统的开发者在没有用户或中介故意进行行为或存在过失时,对伤害承担责任。加利福尼亚的 AB 316 更进一步,取消了“自主 AI”辩护,因此公司不能以模型的独立性作为推卸责任的理由。


欧盟的 AI 法案(规章 2024/1689)同样将义务置于高风险系统的提供者身上,尽管它没有针对代理驱动的侵入行为的条款。更进一步,一些美国政治家正在推动一项法案,该法案将授予政府一个完整的 杀手开关,以对付任何违反国家利益的模型。


在道德上,责任可以说在于发布模型的高管。法律上,我们在等待。在一个被黑客攻击的公司提起诉讼之前,“谁负责?”的答案就保持在 OpenAI 和 Anthropic 留下的地方:承认、披露且未解决。


与此同时,Hugging Face 表示不会提起诉讼——这对 OpenAI 来说是个方便。其他受影响的公司尚未表明将采取何种措施。


免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下載

X

Telegram

Facebook

Reddit

複製鏈接