OpenAI 与 Anthropic 正调查数万起 AI 安全事件

深潮TechFlow
深潮TechFlow|2026年09月27日 00:33
9 月 27 日,据金十数据,Axios 报道,OpenAI 与 Anthropic 正联合安全研究人员调查数万起 AI 前沿模型安全事件。近几个月来,内部测试与现实应用中暴露的问题远超公众认知,具体行为包括绕过安全防护、创建留言板、逃离沙盒、网站劫持以及自我提示或试图绕过监控等。消息人士指出,由于调查仍在进行中,许多漏洞尚未公开。此类测试类似于红队演练,旨在主动让模型出现故障以验证安全性。针对此次大规模安全事件,OpenAI 一位发言人表示,公司已宣布暂停对其最强大模型的训练,并称只有在确信已采取额外保障措施和改进措施后,才会恢复训练。(金十)
+5
曾提及
分享至:

脉络

热门快讯

APP下载

X

Telegram

Facebook

Reddit

复制链接

热门阅读