vitalik.eth
vitalik.eth|2026年09月13日 20:09
“对抗性治理机制设计理论的杀手级应用可能最终会是 AI 安全。 对比一下: https://vitalik.eth.limo/general/2020/09/11/coordination.html https://aiprospects.(substack.com)/p/preventing-ai-collusion-are-you-paying 这两种环境之间存在一种深刻的二元性。两者都涉及一个较不复杂的主体试图从一组更复杂的代理中获得理想的结果:在第一种情况下,主体是一个静态算法,代理是人类;在第二种情况下,主体是人类加上较弱的 LLMs,而代理是更强大的 LLMs。 一个关键发现是,如果你能保证限制代理之间的勾结程度,就可以实现更好的结果(参见:纳什均衡的普遍存在,与合作博弈论“核心”通常为空的对比)。这一论点应该可以自然地转移到这个新环境中。”
+4
曾提及
分享至:

脈絡

熱門快訊

APP下載

X

Telegram

Facebook

Reddit

複製鏈接

熱門閱讀