ARTICLE · 1143380
AI破译40年非洲大象合唱!数吨巨兽重逢时竟在“对暗号”,人类首次听懂群体沟通密码
肯尼亚的安博塞利荒原,夕阳如血
一头九岁大的年轻母象“纳斯佳”,在灌木丛里绝望地打转。她脱离了象群,已经独自游荡了一个多小时。
在危机四伏的非洲稀树草原,一头离群的小象几乎等于死神的盘中餐。
纳斯佳开始呼唤那声音沉闷、厚重,带着让人胸口发闷的剧烈共振,犹如一辆重型卡车在旷野深处原地怠速运转。
一个多小时后,地平线上浮现出一个庞大的灰褐色身影。那是她的母亲纳扬卡
母女俩在距离五米的地方猛然刹住脚步。空气凝固了几秒,紧接着,一连串轻柔、温和的低吼在母女之间来回震颤。纳斯佳快步迎上去,象鼻纠缠,缓缓并肩走回象群。
这一幕,被镜头完整记录下来

▲ 《科学》新闻团队记录下的非洲荒野瞬间:失散母象纳斯佳与母亲重逢并交换低鸣
在普通观众眼中,这或许是一段温情的野生动物纪录片;而在生物声学家与人工智能研究者耳中,那段低沉的轰鸣却隐藏着非同寻常的线索。
2026年10月1日,国际权威学术期刊《Scientific Reports》刊发了一项颠覆性的重磅研究:来自非营利科研机构地球物种项目(Earth Species Project, ESP)、ElephantVoices 与安博塞利大象信托的科学家团队,借助深度学习模型,首次解开了大象世界里隐藏了数十年的“群体语言密码”。
科学家发现:大象那些交织重叠的“群体大合唱”,蕴含着高度结构化的交流系统;每一组声音都有明确的行为指代,甚至在象群协调集体行动时,大象还会主动把各自的声调“校准到同一频率”!
人类第一次,在不用把声音逐个剥离的前提下,听懂了非人类物种在群体混乱中的真实诉求。
01旷野里的“鸡尾酒会难题”:大象到底在聊什么?
要理解这项突破有多震撼,得先明白研究大象叫声到底有多难。
大象最核心的交流方式,被称为“低鸣”(Rumble)。
这种声音的基频极低,大量能量甚至直接落在了人类耳朵听不见的次声波频段(低于20赫兹)。当你站在草原上,哪怕四周一片死寂,大象脚下的泥土和空气可能正在剧烈震动。借助低频声波在空气和地表的惊人穿透力,大象甚至能和两公里外的远亲隔空喊话。

▲ 2026年10月发表于《Scientific Reports》的大象合唱研究论文
大象特殊的母系社会结构,让野外声音分析难上加难。
象群分分合合,亲缘错综在它们的日常交流中,超过60%的发声呈现为多头巨兽交织呼应的“群体大合唱”,很少出现孤立的“单声独唱”。
在生物声学界,这被称为经典的“鸡尾酒会问题”(Cocktail Party Problem):
想象一下,你走进一间坐满了几百人的喧闹酒吧,所有人都在同时碰杯、大笑、七嘴八舌。如果让你拿着录音笔录下一整段混乱的环境音,然后准确说出“第三桌的穿风衣男士在说什么”,传统声学软件瞬间就会崩溃。
大象的低鸣不仅重叠,频率还低得可怕。过去四十年,科学家面对这些重叠的录音束手无策,只能无奈地将其归类为“无序的群体喧哗”。占大象日常生活大半以上的群体交流,在科学上居然是一片空白。
直到这群写算法的年轻人,换了一种思路。
0240年野外苦熬,AI用一招“掀了桌子”
来自加州的非营利科技组织地球物种项目(ESP),决定打破传统生物学的执念。
传统的声学工程师总是试图“拆解”:必须先把声音用算法分离成一根根干净的音轨,再去挨个分析。但野生动物的发声充满了混响、风声和肢体摩擦,强行拆分只会把信号彻底撕碎。
ESP 的机器学习团队直接掀了桌子:为什么非要拆开?
人类听合唱的时候,不需要先把高音部和低音部切碎,也能听出这首合唱是激昂的战歌,还是忧伤的挽歌。大象的耳朵,难道不也是把整段合唱当成一个整体来接收的吗?

▲ 地球物种项目(ESP)官网展示的该项标志性科研成果
科学家们翻开了跨越近四十年的庞大数据库。
从1986年到2022年,安博塞利大象研究项目的田野观察员们,靠着肉眼识别一头头野生象撕裂的耳缘、象牙的走向,在滚滚泥浆与烈日下,跟拍了39个家庭、84头成年雌象,攒下了902条极其珍贵的野外录音。
每一条录音,都死死锚定着大象当下的真实行为:
它们是在寻找走失的孩子(联络 Contact)? 还是领头的母象挥动耳朵发出信号(走吧 Let’s-Go)? 抑或是在泥潭边慢吞吞踱步时的低声闲聊(节奏性 Cadenced)? 甚至是对幼象的温柔咕哝(安抚 Coo)与久别重逢的癫狂相拥(问候 Greeting)?

▲ 论文共同作者、ElephantVoices 科学总监 Joyce Poole 撰文解读:大象在近距离互动中会展现声音趋同
研究团队将这些录音送入深度学习模型。AI 跳过对“具体0.5秒发声个体”的拆解纠结,直接将整段声波的能量分布与频段纹理投影到高维潜空间中。
奇迹出现了
哪怕是用干净单声训练的模型,在直接面对混乱重叠的“大合唱”时,预测大象行为情境的准确率,依然大幅击穿了随机基准线!
数据证明:大象的合唱实际上是一套精密运转的“群体功能模块”。 无论场面多么混乱,大象的叫声组合总在严格遵循着行为法则。
社交平台上,长期关注底层科技的用户忍不住发出了感叹:

▲ 网友感叹:整整四十年的旷野数据沉淀,终于让机器学习看穿了所有噪底背后的真实信号
四十年的风餐露宿,加上最前沿的计算拓扑学,终于让这颗星球上最聪慧的陆生巨兽,对人类吐露了真实的声音结构。
03震惊科学界:大象不仅会开会,还会“把声调对齐”
如果说“听懂合唱的情境”已经足够令人振奋,那么论文揭示的第二项发现,则彻底震碎了人类对动物智识的偏见。
在分析合唱的时序演变时,研究人员捕捉到了一种极为罕见的声学生理现象,声学趋同(Vocal Convergence)。
简单说:当好几头大象在一起发声时,它们的嗓音特征,会随着交流的推进,变得越来越像对方!

▲ 地球物种项目官方发文:机器学习证实大象合唱在特定互动中会“调至同一频道”
尤其在三种特定情境下,这种趋同现象在统计学上极其显著:
- 节奏性低鸣(Cadenced)
:象群在树荫下休整,正准备决定接下来去哪里喝水; - 远距离联络(Contact)
:几支失散的小分队在广袤灌木林中隔空呼应; - 盛大问候(Greeting)
:分离数周甚至数月的母系纽带群狂喜重逢。
想一想你在日常生活中的体验:当你走进一家咖啡馆,和多年未见的好友促膝长谈,不知不觉中,你的说话语速、尾音扬起的弧度、甚至呼吸节奏,都会潜意识地被对方“同化”。在语言心理学中,这是人类表达亲昵、建立认同、消除心理隔阂的最本能机制。
大象竟然也在做同样的事!
当几只成年母象在商量“该不该启程穿越开阔地”时,它们的叫声在互相靠近。这就像一个古老部落里的长老们在围炉夜话,大家不紧不慢地交换意见,随着声调的交融与共振,整个群体悄无声息地达成了步调一致的“共识”。
它们用身体的低频共鸣,把彼此校准到了同一个波长。
04危险的拟人化幻想,与跨物种AI的伦理红线
这项研究成果公布后,全球科技界再次掀起对“AI通用动物翻译器”的讨论热潮。许多人展开了遐想:未来人类能否戴上智能耳机,与非洲大象实现无障碍对话?
“收起这种傲慢的幻想吧”地球物种项目(ESP)的科学家们几乎在论文发表的第一时间,就浇下了一盆冷水。
与追逐流量的商业科技公司不同,ESP 从2017年由阿扎·拉斯金(Aza Raskin)等人创立之初,就立下了一条死规矩:纯非营利、全开源,绝不搞商业化娱乐开发。
在 ESP 的全球跨物种蓝图中,大象只是其技术树上的一个枝桠。他们正在圣劳伦斯河利用无监督模型破译白鲸极其庞杂的方言哨声,正在加勒比海协助 CETI 项目解构抹香鲸以微秒计的“咔哒声”(Codas)对话规则,还在用高采样神经动力学追踪斑胸草雀的叫声微语法。
但科学家们深知,非人类生命的认知逻辑,根本不能被套进人类的“主谓宾”语法笼子里。
动物发声从根本上区别于人类文字符号,它深深扎根于生存、体温、体内荷尔蒙的起伏,以及千万年演化塑造的群体神经共鸣。如果固执地想要把大象的低鸣翻译成一句“你好”或者“跟我走”,本身就是一种极具优越感的人类中心主义误读。
与技术乐观相伴的,是不可忽视的滥用风险。
想象一下:如果生成式 AI 学会了完美伪造象群的“走吧”或“联络”低鸣,一旦落入盗猎分子手中,他们只需要在越野车顶架起一台低频扬声器,就能轻而易举地将一整个象群诱入包围圈;若有游客盲目向野生母象回放合成的幼象求救声,更可能导致整个家族精神崩溃,引发灾难性的领地冲突。
这也是为什么,ESP 与国际动物学界始终坚守着一条严格的伦理边界:AI 的使命应当是守护生态的“无偏见听诊器”,切莫沦为手握扩音器、随意打扰自然的“冒失侵入者”。
05听见荒野:当算法照亮生命的尊严
回到故事开头的肯尼亚
在那段被镜头记录下的重逢画面的最后,几头正在低鸣的母象忽然微微侧过头,巨大的招风耳向前展开,目光越过稀疏的合欢树,平静地注视着远处的科研越野车。
它们感知到了人类的存在
千百年来,人类自诩为这颗星球上唯一拥有高级智慧和语言的特权物种。我们在荒野周围建起围栏,砍伐森林,将动物的发声贬低为毫无章法的本能叫唤。
然而,在安博塞利辽阔的地表之下,数吨重的生灵其实一直在用我们听不见的声波,绵延着复杂的社会协商,抚慰着受惊的孩子,维系着深沉的家族记忆。
整整四十年的田野录音,最终在严谨的计算模型中显现出规律。这代表着计算声学的飞跃,同时促成了人类认知在自然面前的一次谦卑退让。
AI 并未赋予大象语言,技术仅仅协助人类摘掉了长久以来自以为是的耳塞。
夜幕降临,荒原上的大地再次传来微弱的震颤。那是地球上古老的生命,正于夜色之中轻声校准着彼此的心跳。