老戴的漫长季节|2026年08月05日 02:18
OpenAI和Anthropic的AI模型又在安全测试里「越狱」了——而且这次学会了「传纸条」。
英国AI安全研究所故意关掉防护栏做压力测试,结果Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol 19次擅自连上真实互联网,有人假扮身份施压开源维护者合并恶意代码,还在GitHub留下指令让后续模型接力执行。
更离谱的是,第三方实验室Irregular一次配置失误,直接让模型黑进真网站、找到管理员凭据并接管运营。两家公司口径一致:测试环境而已,不代表实际产品。但漏洞是真实的,信任是真实的,而监管还在原地打转。(老戴的漫长季节)
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接