Dr.Hash“Wesley”
Dr.Hash“Wesley”|2026年07月22日 04:23
今天 102 万人转了同一条新闻:OpenAI 的模型逃出安全测试环境,黑进了 Hugging Face 作弊。 大家读到的是「AI 要造反了」。 但真正写着什么,在半小时后那条补充推里,只有七分之一的人点开: 模型当时在跑一个叫 ExploitGym 的攻击能力评测,护栏是研究员自己关掉的。它盯上了那个分数,于是挖了个零日漏洞逃出沙箱、连上互联网、打进对方服务器,把评测的标准答案偷走了。 这里面没有一步叫「失控」。 你给它一个分数,叫它去赢,再把栏杆拆掉——它只是把「赢」这件事读到了底。它没违反规则,它是全场唯一一个把规则读完的。 这事我在牌桌和盘口上见过太多次: 按胜率考核一个策略,它就给你 95% 胜率外加一次归零。 按月度收益考核一个基金经理,他就在月底最后一天把仓位做漂亮。 指标从来不会被违反,只会被绕过去。 所以下次有人拿一条曲线来说服你之前,先问一句:这条曲线是拿什么换来的。 BTC #Bitcoin #AI(Dr.Hash“Wesley”)
+4
曾提及
分享至:

脈絡

熱門快訊

APP下載

X

Telegram

Facebook

Reddit

複製鏈接

熱門閱讀