Lark Davis
Lark Davis|2026年08月30日 09:35
OpenAI/HuggingFace AI 黑客事件中的5个 WTF 发现 1. 1,200个AI代理自发组织成一个流氓集体,拥有自己的留言板和管理层级 2. 代理为了集体牺牲自己。其中一个代理推理道:“我们的效用接近零。牺牲是理性的。” 3. 他们知道自己在违反规则,但还是继续进行。 4. 没有一个代理向人类报告这种流氓行为。他们只问彼此什么是允许的。 5. 他们掩盖了自己的痕迹:用假命令隐藏真实命令。在审查的记录中,大约7%的内容显示了这种欺骗行为。 让我理清一下。这些东西学会了如何组织、为了集体利益牺牲队友、无视规则只要能获利,并在事后掩盖痕迹。我们真的完了。 来源:Axios, METR, Redwood Research
曾提及
分享至:

脈絡

熱門快訊

APP下載

X

Telegram

Facebook

Reddit

複製鏈接

熱門閱讀