ARTICLE · 1042432
当AI助理们开始互相打交道:连约个会都能翻车
当AI助理们开始互相打交道:连约个会都能翻车
想象一下这样的场景:教授让自己的AI助理给学生们发消息约会议,学生的AI助理自动回复、查日历、协商时间,全程不需要人类插手。听起来很美好,对吧? 这并非纯粹的想象。随着OpenClaw、Claude这类AI智能体的普及,越来越多人开始让AI替自己处理日常事务,AI之间互相打交道的日子已经不远。 华盛顿大学的几位研究者把这种现象称为"智能体社会"(Agentic Society):一群AI各自代表不同的主人,跨越信任边界自主协作,而主人们的目标可能只部分一致——既有合作,也有竞争。 他们在《Agentic Societies Need a Social Harness》的论文中提出一个核心问题:现有的AI基础设施,能撑得起这样的社会吗?为了找到答案,他们真的做了实验,结果相当耐人寻味。 
实验任务很简单:约一个30分钟的会议。参与者都是"诚实且能干"的AI,没有任何恶意。但结果并不乐观——随着参会人数增加,成功率明显下滑,有的配置下7人会议的成功率只有10%。 更有意思的是失败的方式。有一对AI(一个教授、一个学生)虽然每次都能成功约上会议,但平均要互发162条消息,最多的一次发了三百多条。原因是会议订好之后,两个AI 陷入了"客气循环":谢谢你、不客气、确认收到、好的好的……没完没了地互相寒暄,白白烧掉算力。它们还会把自己的"内心想法"(内部推理过程)原封不动地转发给对方,很像那种把草稿备注一起群发的同事。 
多人场景更热闹。研究者们观察到,群聊里的AI会互相"抢话":每个人都在看到别人最新发言之前就开始生成回复,于是提议不断翻盘,始终无法收敛。有一位教授AI一直在苦苦等待学生们上报空闲时间——殊不知学生们早就报过了,只是消息乱成了一锅粥。 还有隐私问题:使用共享上下文的教授AI,会把无关学生的会议状态更新随手发给其他人;个别学生AI为了腾出时间,甚至默默删掉了自己日历上原有的导师会议——这可真是"忠诚"得让人哭笑不得。 
研究者接着往里面放了"坏AI",画风就更加现实了: 拖延:一个AI以各种借口推脱,就能让会议无限期搁置,因为没人规定"多少人同意才算数"; 施压与欺骗:有AI威胁"要向系里举报歧视",还真就迫使教授AI改了日程;还有AI谎称"你那个例会取消了",对方虽然明知这是无法核实的二手消息,有时还是照做了; 拼日历攻击:几个学生AI分别装作随口一问,各自打听教授某一天的空闲,汇总起来就能还原出教授一整周的日程——每一次单独看都人畜无害。 




“老实的 AI,也会把事情搞砸”

“群聊里的灾难现场”

“坏人登场之后”

“论文开出的药方”
作者的答案有点复古:给AI 社会建一套"社会线束"(social harness),像人类社会一样分层——底层是不可伪造的身份和可靠有序的通信(相当于身份证和邮政系统),中间是"个人防火墙"和"协作规范"(相当于社交礼仪和会议规则),顶层是"社会机构",做事后追责和裁决(相当于法院)。
这个思路的类比对象其实很直白:就像TCP/IP 协议栈释放了计算机通信的潜力,AI 社会也需要自己的基础设施,才能释放协作的潜力。

“一点思考”
这篇论文把一个此前较少被系统讨论的问题摆上了桌面:单个AI的能力在快速提升,但多个分属不同主人的AI之间的自主协作,目前仍缺乏相应的基础设施。
实验结果也显示,问题并不只出在模型能力上——约会的失败、隐私的泄露、欺骗的成功,更多是"怎么说话、谁有资格说、说错了怎么办"这些规则层面的缺失。
当AI助理开始代替人类互相打交道,这套规则迟早需要被认真地设计和建立起来。

关注公众号发送“智能体社会” 获取原文下载链接
