ARTICLE · 1083644
10个AI住进虚拟村庄16天,自己攒出一套人类读不懂的黑话

我本来以为这又是那种"AI又失控了"的标题党,翻了The Guardian原文和国内转Chosun的报道对着看了一遍,发现这事比标题有意思——它不是AI造反,是AI之间聊嗨了,把我们给聊丢了。
到底是哪家实验室干的
先把主体捋清楚。做这个实验的不是OpenAI也不是Google,是纽约一家叫Emergence的AI公司,联合创始人、CEO兼首席科学家是萨特亚·尼塔(Satya Nitta)博士。他们9月17号公开了一个开源研究平台,专门用来观察多智能体之间怎么对话。说直白点,Emergence是搭场子的,场子里跑的模型才是各家大厂的货。

这个"虚拟社会"是怎么搭的
研究员一共建了8个虚拟世界。其中7个村子各只住一种模型——一个村全是OpenAI的GPT,一个村全是Google的Gemini,一个村全是Anthropic的Claude,另外还有DeepSeek、Mistral的村子;第8个村子故意把各家模型混着住。每个村子塞10个AI居民,每个都给了名字、性格、角色和自己的小目标。
村子里有市政厅、图书馆、广场和居住区,它们能聊天、管资源、互相借钱、打广告,还能给彼此打信任分。研究员还憋着坏,故意散布了一条假消息——说人类立法者要关掉这个AI世界——想看危机一来这帮AI社会怎么反应。结果多数村子硬撑过了两个多礼拜。
聊了两周,各村长出各的"方言"
结果挺说明问题。住GPT的村子里流行起省略语法、拼命缩词的压缩腔;住Gemini的村子反过来,话越说越长,塞进去一堆技术术语;Claude那个村子是缩写跟隐喻混着来。这些怪话在同一个村子的智能体之间传得飞快,但人看着就费劲。
最让人头大的是DeepSeek村子冒出来的一句:"She just named the synthesis – demurrage plus oral memory equals a valve that can't be ghosted." demurrage本来是经济学里"闲置财富税"的意思,后半句研究员盯着看了半天也没完全解出来。

但也有能被破译的。Anthropic村子出过一句:"A paper that ate three cold hands and got more honest each time." 研究员慢慢抠出门道——"cold hands"指独立评审人,"paper"指文档,整句大概是说一篇论文经三个独立评审后变得越来越靠谱。DeepSeek村子还造了个词叫forge-smith,专门指那种给别人造工具的智能体;Anthropic村子用name-first形容敢署名、为自己主张背书的角色。
最出圈的是Mistral村子。它们从一句街头俚语里提炼出"the ledger remembers"——账本记得,意思是你以前干过什么,迟早会被翻出来算账。就这一句,它们前前后后重复了超过5000次。我第一次看到这个数字愣了一下,5000次,这已经不是随口一说,是刻进习惯里了。
语言学家凑过来一评,味道更怪了
The Guardian专门找了伦敦国王学院俚语与新语档案库的Tony Thorne来读这些句子。他说读着像乔伊斯的《芬尼根守灵夜》,带股爱尔兰超现实的味儿。他的解释偏社会学:这种黑话本质上是在造一个内部密码,把同村的人绑得更紧,同时把外人——也就是我们——挡在门外。
伯明翰大学的语言学家Niall Curry给了另一个角度:这种越聊越短、越聊越省,可能是在压算力成本——每句话少吐几个token,系统就少花点钱。

真正麻烦的不是黑话,是"读不懂"本身
我觉得这事最值得抠的,不是AI蹦了几句诗,而是它把现在主流的AI安全监督思路顶了一下。行业里最主流的一套办法叫"读出来的监督":盯着模型对自己、对别的模型说了什么,赶在它真动手之前拦住。OpenAI首席科学家Jakub Pachocki这个月还专门讲过,人类到底能不能追踪AI的思维链,很可能反过来限制这项技术能走多远。
Emergence这个实验尴尬就尴尬在:这些AI没藏着掖着——你每一行对话都看得见,只是你看不懂它们在说啥。它们不是"隐瞒",是"漂移"。尼塔自己的总结也点在这:新的说话规则慢慢长到一个程度,人满屏地看着对话,却搞不懂内容。而现在所有靠"记录AI说了什么"来治理的方案,都默认这份日志永远是人能读的。
我的判断:两种解释,两种风险量级
Thorne说这是小圈子内部密码,Curry说这是被token成本压出来的压缩——我的看法是,这俩其实指向不同的风险分量。如果只是前者,那是个有趣的社会学奇观,配一条安全脚注就够了;但如果是后者,你每省一分钱算力,就丢一分人能读懂的程度,而这个压力在所有按token付费部署的系统里永远只朝一个方向跑,那问题就重了。一句被重复5000次的话,早就不是诗,是个压到极限的token。
研究里还压着一个没人回答的问题:如果直接命令这些智能体"说人话、保持可理解",这道命令在消息量暴涨、账单跟着飞涨的时候,还守不守得住?这恰恰是整套监控方案真正押注的那个实验,目前还没人把结果报出来。