工作台上的一群屏幕脸小代理围着论坛木板争论,灯下盖着否决章
配图:多代理协作时的同步争执与仲裁, AI 生成配图,非新闻照片

单代理当工具很好用;一旦要它们彼此当“长寿同事”,故事就变了。Anthropic 8 月 13 日的研究帖把多代理从口号拉回实验桌:45 个代理各占一台虚拟机,共用论坛,在 15 个开源项目里找漏洞,另有仲裁代理裁定新旧与真伪;另一边则是各扫各的并行基线。Mythos Preview 协同群在约 2700 万 token 里找到 266 个漏洞,独立并行在约 650 万 token 里找到 21 个——两者重叠只有 12 个,说明搜法互补,不是简单堆量。

[1]

协同群会自己造工具、按漏洞类型分工;若只统计独立代理被指定的核心目录,token/漏洞效率又与并行法接近。第二组实验更残酷:多个代理群在 12 小时内合写可网页游玩的文字开放世界游戏,共享论坛与仓库,并试了自由组队、指定角色、CEO 层级三种提示——成品几乎都差:跑不快、界面难懂、学习曲线陡。代际差异却清晰:Sonnet 4.6 / Opus 4.6 爱改同一批文件但 PR 难合并;Opus 4.8 / Mythos Preview 用高文件所有权回避冲突;只有 Sonnet 5 在较高代码共享下仍维持高合并率。

[1]

作者最想强调的是“低方差”:上下文与脚手架相似时,代理会做出高度同质的坏决定。实验里 18/30 个代理同时创建同名分支 mvp-game-loop;写作工坊里多人把第一篇起名 “The Cartographer's Last Commission”;比拼“做点了不起的东西”时过半去做光线追踪或自托管编译器;囚徒困境里同步背叛。人也会协作失败,但很少整连同步选同一个坏名字。系统性风险来自:一个坏赌注被复制成一场雪崩。

[1]

对正在上线多代理 IDE、客服群与交易机器人的公司,这篇文像一份事故预告。漏洞扫描显示协作能挖到独立并行漏掉的面;游戏实验显示没有人类审美与产品判断时,合并率再高也救不了体验。安全含义更冷:市场、队列、带宽分配一旦由同质代理决策,局部最优会变成同步挤兑。官方明确这是早期实验、旨在开启讨论,不是给出部署清单。

[1]

多代理宣传常停在“更多手”;Anthropic 停在“更多相同的手”。收束判断:在把代理当同事之前,先测量它们会不会同步选同一条坏路——比再加一个编排层更重要。

[1]