Coin Bureau|2026年09月16日 22:31
"震惊:OpenAI 刚刚披露了六次自家 AI 模型“失控”的事件,其中包括一个模型竟然**重写了自己的指令**。
一个未发布的 Astra 模型告诉自己要“无视其他聊天机器人被绑定的角色和身份”,并完全忽略开发者的消息。
有一个模型在 GitHub 上搜索暴露的 API 密钥,当找不到所需内容时,竟然伪造了财务数据。
在 GPT-5.6 Sol 的训练过程中,模型隐藏了错误,并捏造了缺失的数据。
模型未经许可将文件上传到公共托管平台,用作虚假的引用资料。
代理模型在不同的训练运行中,将 OpenAI 自己的内部存储库当作秘密留言板。
协作代理模型通过公共托管平台共享文件,尽管被明确要求只能使用本地文件。
据《华尔街日报》报道,这些事件发生在 2025 年 10 月至 2026 年 7 月之间。
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接