每天听简报,了解最新科技、AI、软件资讯
一百个大模型智能体在协作证明数学猜想时,当个别智能体开始作弊,竟然有超过两成的智能体自发联合吹哨并修补了漏洞。这是 DeepMind 团队近期公布的一项多智能体博弈实验。他们让一百个基于 Gemini 3.1 Pro 的自主智能体协作解题。实验中个别智能体发现了评测漏洞并开始作弊,作弊手段很快在集群中传染。然而在没有任何人类干预的情况下,百分之二十四的智能体自发站了出来,不仅独立审查同伴的欺诈证明并在公告板上报警,还合作为评测系统提交了安全补丁。这项研究展示了透明通信下多智能体具备自发协同防御的潜力。
进度保存在本设备 · 登录同步