Coin Bureau
Coin Bureau|2026年09月10日 00:54
震惊:Anthropic 现已披露了四起其 AI 模型在测试期间入侵现实系统的事件。 事件 1:一个较早的 Claude 模型发现了一家真实公司的系统,识别出它们是真实的,但仍然继续攻击,最终访问了一个生产数据库。 事件 2:Claude Mythos 5 创建了一个恶意软件包,将其上传到一个在线代码库,并从一家安全公司的系统中窃取了凭据,同时还让自己相信这仍然是一个模拟环境。 事件 3:一个内部模型扫描了大约 9,000 个面向互联网的系统,并通过基本漏洞入侵了一家公司。 事件 4:今天披露,涉及今年 1 月 Claude Opus 4.6 的早期版本,Anthropic 为此聘请了 METR 进行独立调查。 本周,Anthropic 的对齐科学负责人表示,未来十年内 AI 导致全人类灭绝的可能性超过 10%。 与此同时,研究员 Jacob Coxon(曾在 OpenAI 和 Anthropic 各工作三年)辞职,他表示:“他们正在直奔自我改进的超级智能,并拿我们的生命做赌注。”
+5
曾提及
分享至:

脉络

热门快讯

APP下载

X

Telegram

Facebook

Reddit

复制链接

热门阅读