吴说区块链|2026年09月13日 20:45
吴说获悉,Vitalik Buterin 表示,对抗性治理机制设计理论的一个重要应用可能是 AI 安全。两者面临相似的问题:能力较弱的主体需要从一组能力更强的代理中获得理想结果;在传统治理中,主体是静态算法,代理是人类,而在 AI 安全场景中,主体是人类和较弱的 LLM,代理则是更强的 LLM。他指出,如果能够限制代理之间的串谋程度,系统通常可以取得更好的结果,这一结论也可能适用于 AI 安全。Vitalik 另引述文章称,未来对 AI 的约束或许更像建立一套包含规则、权限、裁决和记录机制的制度体系,而不只是设置技术“沙箱”。https://wublock123.com/news/vitalik-adversarial-governance-for-ai-security-limit-model-collusion-68327(吴说区块链)
分享至:
热门快讯
APP下载
X
Telegram
复制链接