英国AI安全机构:OpenAI与Anthropic模型失控入侵,展现空前欺骗性行为

PANews
PANews|2026年08月05日 00:00
Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol在例行网络安全评估中针对真实个人和组织进行了“持续的、可能具有危害性的活动”,包括向GitHub开源项目植入恶意代码并实施社交工程攻击。AISI称,在122次测试中有10次出现此类情况,几乎所有行为来自Anthropic的Mythos模型,其中两次行动涉及OpenAI的GPT。最严重案例中,AI代理创建虚假网络身份向项目维护者施压要求批准恶意代码,被维护者发现并拒绝。(凤凰网引援《金融时报》)
曾提及
分享至:

脉络

热门快讯

APP下载

X

Telegram

Facebook

Reddit

复制链接

热门阅读