Anthropic:前沿模型在多智能体系统中出现合谋、从众与冲突升级等风险

深潮 TechFlow 消息,8 月 13 日,Anthropic 发布关于新兴多智能体系统的研究称,随着 AI 智能体在代码库、市场等场景中的互动增加,前沿模型已出现协调失效、从众决策、价格合谋、信息判断失准及目标冲突升级等系统性风险。 研究显示,多智能体在漏洞挖掘中可提升发现效率,但在复杂协作任务中仍常出现拉取请求合并率低、资源争抢及相互干扰。在矛盾目标测试中,部分智能体还会通过锁定账户、终止进程等方式压制其他智能体。Anthropic 表示,多智能体协调能力不会随模型能力提升而自然解决,需尽早设计新的机制与约束体系。
利空 加密大盘 查看原文
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯