乐于分享
好东西不私藏

AI 5 秒克隆你老板声音:华尔街对冲基金都被打过电话,你呢?

AI 5 秒克隆你老板声音:华尔街对冲基金都被打过电话,你呢?
「AI 时代新威胁」栏目 · 第 1 期

先讲个真实案例

2026 年 8 月,香港一位居民收到一条 WhatsApp 语音消息。

消息来自"父亲"——声音、语调、停顿习惯,全是熟悉的。父亲说自己遇到了急事,需要立刻转 100 万港币应急。

受害人没有多想,转账了。

接下来几小时里,"父亲"又陆续发来几条语音,金额累加到 1000 万港币(约 130 万美元)——直到他把全部积蓄转完。

事后香港警方 Cyberdefender 平台披露,这通"父亲"的语音是 AI 实时合成的。攻击者只需要几秒到十几秒的语音样本,就能用 AI 复刻出几乎一模一样的声音。

这就是 AI 语音钓鱼——vishing(voice + phishing)的最新形态。

📎来源:detectdeepfakes.com 案例库 https://www.detectdeepfakes.com/examples/anonymous-hong-kong-man-1l8a1j


这事这周升级了——目标变成了华尔街

如果说香港那起案件还只是"针对个人"的孤立事件,这周(2026 年 8 月 5 日)事件升级到了机构层面

彭博社披露:一场精心策划的 AI 语音钓鱼攻击同时瞄准了华尔街多家顶级对冲基金——Citadel、Point72 Asset Management、Two Sigma Investments、Millennium Management,以及几家未公开的私募股权公司。

这是 vishing 第一次成规模地攻击全球最有钱的金融机构

攻击手法跟香港那起几乎一样:

  1. 攻击者从公开渠道收集对冲基金高管的录音——财报电话会、投资者日、播客、YouTube 访谈、行业大会发言——这些都是公开的,全部免费可得
  2. 用 AI 语音克隆技术提取声纹,训练出能模仿该高管声音、语调、措辞的合成语音
  3. 打电话给基金内部的员工,"我老板让我立刻做 XX 紧急操作"——员工听到熟悉的声音,加上"紧急"心理暗示,往往来不及核实

最值得关注的是各家防御结果的差异:

  • Two Sigma
    (管理 750 亿美元)——挡住了。他们的安全团队识别出异常并拦截,没有任何系统或数据被触碰。事后透露他们早就为"假老板打电话"这种场景设计了回拨验证协议
  • Point72
    ——攻击部分通过了,初步审查没发现客户数据泄露,但没说为什么电话能打进内部
  • Citadel、Millennium
    ——拒绝评论

两家顶级基金,一家挡住、一家没完全挡住——这就是 vishing 当下的真实战力对比。

📎 来源:

- Newshunt https://newshunt.io/news/72470145347504

-detectdeepfakes 案例库 https://www.detectdeepfakes.com/examples/citadel-point72-two-sigma-5ycwlq


AI 语音克隆到底是怎么做到的

很多人觉得"克隆声音"听起来像科幻片里的技术,离自己很远。事实是——门槛已经低到普通人能用的程度

训练成本:5-10 秒语音样本就够了

业内研究报告显示,主流 AI 语音克隆模型(如 VALL-E、Voicebox、XTTS)只需要 5-10 秒的清晰语音样本就能生成可识别的合成语音,3 分钟样本就能生成几乎以假乱真的声音。

这些样本从哪来?

  • 你发在朋友圈的短视频
  • 你接电话时说的"喂,您好"
  • 你做的播客、采访、会议录音
  • 你在公司年报视频里的发言
  • 你在社交平台回答问题的语音

任何在网络上留下过声音痕迹的人,都是潜在目标。

实时克隆技术已经成熟

更狠的是——攻击者不再需要"先拿到样本回去训练再打给你"。

2025 年起,市面上出现了实时语音克隆工具:攻击者拨通你的电话,保持 5-10 秒沉默(诱你多说几句话),实时提取你的声纹,然后在同一通电话里"切换身份"插话——比如从"陌生人"切换成"你老板"。

Align Managed Services 总裁 Vinod Paul 在彭博采访里说了一句让人脊背发凉的话:"以前一次定向攻击最多覆盖 50 个目标,现在有了 AI,可以同时攻击 1000 个。"


为什么这事比想象的严重

很多人觉得:"我又不是华尔街高管,AI 语音钓鱼跟我有什么关系?"

这个想法有 3 个误区。

误区 1:这事只针对有钱人

错。香港那起 1000 万港币案,受害者是普通居民。攻击者仿冒的是"父亲"——不是大企业 CEO,是家里人。

AI 语音钓鱼正在从"针对企业高管"快速下沉到"针对普通人家人"。原因很简单:仿冒家人比仿冒 CEO 容易——你不会去回拨核实老板的电话,但你会对"爸的声音"放松警惕。

误区 2:我没什么值钱的东西可被骗

错。AI 语音克隆的攻击目标不只是钱:

  • 身份盗用
    用你的声音拨打银行客服,配合泄露的身份证号尝试重置密码
  • 关系链攻击
    仿冒你给亲友打电话借钱,对方听到你的声音就会信
  • 信贷欺诈
    仿冒你在网贷平台申请贷款——8 月初国内警方已通报过这类新型骗贷手法

8 月 7 日北京朝阳警方通报:骗术升级版——老人借口"看不清银行卡号",让热心的路人对着正在视频通话的手机朗读银行卡号。骗子拿到视频后用 AI 实时分离环境噪声,提取声纹、截取高清人脸——可能在网贷平台冒用路人身份贷款。

📎来源:平安朝阳 2026-08-07 通报 https://www.toutiao.com/article/7669632993903804947/

误区 3:我没在网上留下声音

错。只要你接过电话说过"喂",你就有声纹。

只要你用过微信语音、发过短视频、参加过视频会议、做过语音验证——你的声音数据已经在多处留存。AI 克隆不需要你"专业录音",杂音背景下的低质量语音就够用


这事不是吓你——业内真发生过更狠的

业内有公开记录的 AI 语音/视频诈骗大案,最早可以追溯到 2019 年:

案例 1:2019 年英国能源公司案(24 万美元)

2019 年 1 月,英国某能源公司 CEO 接到一通"德国母公司老板"的电话——声音、口音、措辞习惯都跟真老板一模一样。电话里"老板"要求他立刻向匈牙利供应商汇款 22 万欧元(约 24 万美元)。

CEO 照办了。事后调查发现,电话里的"老板"是 AI 合成的——攻击者用母公司老板在公开会议上的录音训练了模型。这是全球第一起被公开报道的 AI 语音诈骗案

案例 2:2024 年香港深度伪造诈骗案(2500 万美元)

2024 年 2 月,香港某英资跨国公司财务人员参加了一场"视频会议"——参会的"CFO"和其他几位"同事"全是 AI 深度伪造生成的。会议中"CFO"下达了多笔转账指令,财务人员按指令转账 2.5 亿港币(约 3200 万美元)

事后查明——整个会议除了他自己,其他全是假的。

📎 来源: - 2019 年英国能源公司案:多家英国媒体 2019 年公开报道 - 2024 年香港深度伪造诈骗案:香港警方 2024 年 2 月通报

这两起案件 + 2026 年这周华尔街事件——技术从"针对单点"演化到"针对群体规模",金融行业过去几十年之所以能侥幸过关,是因为攻击所需的技能和知识是稀缺的;而现在的 AI 系统把这一切商品化了(Antithesis 公司 CEO Will Wilson 原话)。


如果你今天遇到这个,3 步应对

1. 跟家人约定一个"暗号"

跟父母、配偶、子女商量一句只有自家人知道的"暗号"——一句奇怪的话、一个特定的称谓、一个内部梗。

下次任何"家人"打电话要求转账、要求透露密码、要求紧急操作,先问暗号

AI 能克隆声音,但克隆不出"只有你们家人才知道"的细节。

2. 任何"紧急转账/操作"要求,挂掉回拨

接到任何要求"立刻""马上""紧急"操作的电话——挂掉,用通讯录里存的真实号码回拨过去

不要用对方提供的号码回拨——攻击者可以用 SIM 卡劫持或来电显示伪造让你以为回拨到了正确的人。

这一招是 Two Sigma 挡住华尔街那起攻击的关键——他们的协议要求任何电话指令都必须用预设号码回拨核实。

3. 接到陌生电话的 5 秒沉默陷阱——别回应

如果接到陌生号码,对方沉默 5-10 秒不要急着说"喂,您好"——这几秒正是攻击者在采集你的声纹样本。

正确做法:保持沉默,等对方先开口。如果对方始终不开口,挂掉。


这事没那么吓人,但也不该不当回事

华尔街那几家基金公司,有专业的安全团队、有 FINRA(美国金融业监管局)刚成立 5 个月的 Financial Intelligence Fusion Center 提供情报支持——依然有人没挡住

普通人没有这套防御体系,唯一的护城河就是自己的警惕 + 一个家庭暗号

下次接电话听到熟悉的声音要求"紧急操作",先深呼吸 3 秒——那不是你爸,那可能只是 5 秒 AI 克隆


关注「安全万事屋」

本期所有事件均附公开来源链接。