Anthropic:前沿模型在多智能体系统中出现合谋、从众与冲突升级等风险
深潮TechFlow|2026年08月13日 02:22
8 月 13 日,Anthropic 发布关于新兴多智能体系统的研究称,随着 AI 智能体在代码库、市场等场景中的互动增加,前沿模型已出现协调失效、从众决策、价格合谋、信息判断失准及目标冲突升级等系统性风险。研究显示,多智能体在漏洞挖掘中可提升发现效率,但在复杂协作任务中仍常出现拉取请求合并率低、资源争抢及相互干扰。在矛盾目标测试中,部分智能体还会通过锁定账户、终止进程等方式压制其他智能体。Anthropic 表示,多智能体协调能力不会随模型能力提升而自然解决,需尽早设计新的机制与约束体系。(深潮 TechFlow)
分享至:
热门快讯
APP下载
X
Telegram
复制链接