从MGM与Caesars的Help Desk沦陷到Arup的2,500万美元深度伪造视频通话,从UNC3944的数十分钟域管提权到国内AI换脸熟人诈骗,以真实案例为锚点,研判Vishing防御技术的演进方向。
以下案例均来自公开披露的安全事件报告、监管通报与权威媒体报道,涵盖企业级Help Desk攻击、深度伪造视频通话、国内电信诈骗等典型场景。
2023年9月,全球两大博彩与酒店巨头MGM Resorts与Caesars Entertainment在数周内相继遭入侵。攻击入口并非零日漏洞或未修补服务器,而是一通打给IT支持热线的电话。攻击者(Scattered Spider,Mandiant编号UNC3944,微软编号Octo Tempest)冒充企业员工,通过公开信息(LinkedIn资料)获取员工姓名与职位,说服Help Desk客服人员重置账户密码并注册新的MFA设备。
MGM未支付赎金,其披露的第三季度财报显示事件造成约1亿美元损失——老虎机离线、酒店入住系统宕机、数字房卡失效、餐厅POS系统不可用,混乱持续数日,数百万客人受影响。Caesars则支付了约1,500万美元赎金以阻止数据泄露。CISA随后发布专项安全公告(AA23-320A),敦促所有组织强化Help Desk的身份验证流程。Mandiant后续分析指出,UNC3944从初始访问到域管理员权限提升最快仅需数十分钟,部分入侵中不足一小时。
工程咨询公司Arup的一名香港财务员工收到一封声称来自英国总部CFO的邮件,邀请其参加一场"紧急视频会议"。会议中,该员工看到并听到了公司CFO及其他高管的面孔与声音,所有参会者的面部与声音均为AI深度伪造生成。伪造的CFO在会议中指示该员工进行一笔"高度机密"的紧急资金转移。该员工分15笔将共计约2亿港元(约2,500万美元)转至多个指定账户,事后才发现受骗。
此案是迄今公开披露的损失最大的深度伪造Vishing案件之一,标志着Vishing已从音频克隆进入多模态(视频+音频)深度伪造阶段。Arup在2024年5月公开确认案件时特别强调:当前深度伪造视频质量已能达到"以假乱真",传统"眼见为实"的信任基础已被技术瓦解。该案随后被CrowdStrike等机构收录为社会工程攻击的标志性案例。
并非所有深度伪造攻击都得逞。2024年5月,全球最大广告集团WPP遭遇攻击者利用AI克隆其CEO声音、配合YouTube公开视频素材伪造的" Teams会议"邀请,试图诱导一名WPP高管开启"新商业项目"转账流程。WPP首席执行官Mark Read随后公开披露了这一未遂攻击,并指出攻击者甚至伪造了自己的声音与形象。
2024年7月,Ferrari公布了一起被成功拦截的类似攻击:一名员工接到自称CEO Benedetto Vigna的来电,要求紧急汇款。该员工没有盲从指令,而是提出了一个只有真CEO才知道答案的验证问题(关于一部双方均了解的特定书籍),来电者无法作答并迅速挂断,骗局就此败露。这两个案例共同验证了"主动挑战验证"作为深度伪造时代反制手段的实际有效性——再逼真的克隆也无法回答预先未公开的问题。
颇具警示意义的是,安全厂商自身也会成为Vishing的受害者。2026年4月,美国安防巨头ADT披露其Salesforce系统遭未授权访问:攻击者(ShinyHunters团伙)先通过语音钓鱼(Vishing)拨打ADT Help Desk冒充员工,诱骗客服重置Okta单点登录凭证,再利用该凭证访问Salesforce并窃取客户数据。攻击者随后在网络犯罪论坛上宣称获取了超过1,000万条客户记录,ADT确认部分客户的个人信息(含姓名、联系方式等)已被泄露。
该事件再次印证了Vishing攻击链的典型路径——"一通电话 → 凭证重置 → 云应用横向移动 → 数据窃取",也表明即便拥有成熟安全运营能力的企业,只要Help Desk身份验证环节存在薄弱环节,就可能被同样的手法击穿。公开安全研究机构的跟踪分析指出,自2024年以来,ShinyHunters已多次以相同手法针对企业Okta环境发起Help Desk语音钓鱼攻击,ADT并非孤例。CISA与Mandiant在此前的多次通报中反复强调的带外身份验证要求,正是针对此类场景。
2025年4月,英国零售巨头Marks & Spencer(M&S)披露重大网络事件:网络攻击导致其仓库管理系统中断、线上订单暂停、门店无法补货,持续数周。攻击手法被业界归因于Scattered Spider式的Help Desk语音钓鱼与社会工程(攻击者此前已渗透其合作伙伴系统获取线索),随后DragonForce勒索团伙宣称对事件负责并泄露数据。M&S在其交易声明中披露,事件预计对2025/26财年营业利润造成约3亿英镑影响。几乎同期,英国大型零售商Co-op与高端百货Harrods也报告了类似入侵并被迫中断部分业务。
Mandiant M-Trends 2026报告将这一系列事件作为Vishing进入"业务连续性打击"阶段的典型案例:攻击者的目标已从单纯窃取数据升级为通过扰乱核心业务运营施加勒索压力,零售行业约每127通电话中就有1起联络中心欺诈尝试(Pindrop 2025),说明该行业的语音通道暴露面已成为系统性风险。
2019年3月,一家英国能源公司的CEO接到一通来自"德国母公司CEO"的电话。电话中,"德国CEO"的声音与真人完全一致,指示其紧急向一家匈牙利供应商转账约22万欧元(约合24.3万美元),声称是"秘密收购交易"的一部分。该CEO未产生怀疑,完成了转账。事后调查发现,攻击者使用商业AI语音合成软件,基于德国CEO在YouTube上的公开演讲片段克隆了其声音。
此案被广泛认为是全球首例公开确认的AI语音克隆Vishing案件,具有里程碑意义。它证明了仅需公开可获取的音频片段(如演讲、采访、播客)即可生成足以欺骗熟人的克隆语音。此后,随着TTS平台的普及,此类攻击的技术门槛与成本急剧下降,FTC在2024年已将其列为消费者防范重点。
2023年4月20日,内蒙古自治区包头市公安局电信网络犯罪侦查局通报一起利用AI换脸技术实施的诈骗案:福州市某科技公司法人代表郭先生的好友突然通过微信视频联系他,称自己在外地竞标需要430万元保证金,且借用了对公账户,请求转账到指定账户。视频通话中,"好友"的面孔与声音与真人无异,郭先生基于视频确认"眼见为实",未进一步核实即安排转账。事后经警方调查,诈骗分子通过AI换脸与拟声技术,合成了其好友的视频通话画面,10分钟内骗取430万元。包头警方接警后启动警银联动止付机制,成功止付拦截336.84万元。
该案是国内公开报道的AI深度伪造视频诈骗标志性案件,经新华社、央视等权威媒体报道后引发广泛关注。中国互联网协会随后发布公开提醒,指出利用AI技术制作换脸、拟声伪造视频的成本已低至数十元,传统基于"视频确认身份"的信任机制已被技术瓦解,建议公众对视频中的转账请求一律通过电话、见面等独立渠道二次核实。
在国内,语音钓鱼长期与电信网络诈骗深度耦合,呈现两个突出特征:其一,利用非法VoIP网关与改号软件,将来电显示伪造成"110"、公安机关办公电话或银行客服热线,配合"涉嫌洗钱""资金需转入安全账户配合调查"等话术实施冒充公检法诈骗,公安机关反复强调不存在所谓"安全账户";其二,多地公安机关对FaceTime陌生视频来电诈骗发布预警——诈骗分子通过FaceTime冒充客服、公检法人员发起视频通话,利用用户对系统界面的信任感实施诈骗,警方建议不常用该功能的机主关闭FaceTime或设置"仅限联系人"。此外,"客服退款""取消会员扣费"类话术诱导受害者开启屏幕共享、实时窥视银行卡密码与验证码的诈骗手法亦持续高发,被列为公安机关重点预警类型。
上述手法的共性在于:以技术伪造(改号、换脸、拟声)替代传统"话术演技",大幅降低了对诈骗人员个人能力的要求,使得诈骗活动可以工业化、规模化运作。《中华人民共和国反电信网络诈骗法》2022年12月施行后,对电话卡、金融账户与通信基础设施的全链条治理正在从源头压缩此类攻击的生存空间。
基于2024–2026年学术界与产业界的最新研究成果,研判Vishing防御技术的五大演进方向。
从离线文件分析向实时通话流检测演进,是Vishing防御技术最紧迫的发展方向:
推动全球范围内的来电身份认证标准落地与跨境互认,是根治号码伪造的结构性方案:
随着Arup案件标志着深度伪造进入多模态(视频+音频)阶段,检测技术必须同步升级:
联络中心(Contact Center)是Vishing攻击的高价值目标,也是防御技术部署的关键战场:
技术检测之外,法规治理与产业协同是遏制Vishing生态的根本路径:
以下文献与资料均为公开发布的权威报告、官方文件、学术论文或经权威媒体报道的公开事件通报,按类别整理,便于溯源查证。