深度伪造语音与视频如何与商业邮件欺诈(BEC)组合成完整攻击链?

1 深度伪造语音与视频如何与商业邮件欺诈(BEC)组合成完整攻击链?
官方记录的伪造能力

FBI IC3 在 PSA241203 中分项列出了犯罪分子实际使用的生成能力。AI 生成音频(又称声音克隆,vocal cloning):犯罪分子可用 AI 生成音频冒充知名公众人物或本人的亲近关系人以骗取付款;公告举出的具体形态包括生成含亲人声音的短音频片段,冒充处于危机情境中的近亲索要紧急财务援助或勒索赎金,以及利用个人的 AI 生成音频片段冒充其本人以获取银行账户访问权。AI 生成视频:犯罪分子用 AI 生成视频制造对公众人物的可信描绘以强化其骗局,公告明确列出「生成视频,用于与所谓的公司高管、执法人员或其他权威人物进行实时视频聊天」,以及在私下通信中制作视频以「证明」线上联系人是「真人」。AI 生成图像:包括生成虚假身份证件,如假驾照或(执法、政府、银行的)资质凭证,用于身份欺诈与冒充骗局。

典型攻击链拆解
  1. 情报收集:从公开渠道获取高管姓名、职务、汇报关系、供应商名单,以及公开演讲、财报电话会、宣传视频中的语音与影像素材。
  2. 邮箱立足:通过钓鱼或中间人式(AiTM)会话劫持取得某内部邮箱访问权,或注册与真实域高度近似的仿冒域。
  3. 线程劫持与铺垫:介入真实的采购或付款邮件线程,以真实上下文提出账户变更或紧急付款请求,规避「凭空来信」的怀疑。
  4. 跨渠道验证的伪造:当财务按流程发起「打电话/开视频核实」时,攻击方以克隆语音接听,或以伪造视频参加临时会议——IC3 记录的实时视频聊天能力正是针对这一环。
  5. 资金转移与掩盖:款项转入受控账户后迅速分散;同时在被控邮箱内建立自动转发或删除规则以延迟发现。
为什么传统 BEC 控制会失效

多数企业的 BEC 防线建立在「异常请求须经第二渠道核实」这一假设上,而第二渠道通常是电话或视频。IC3 记录的能力恰好击穿了这一假设:语音与影像不再是可信的身份凭证。同时,公告在「AI 生成文本」部分指出犯罪分子可借助 AI 修正原本可作为警示信号的人为错误,使邮件本身的可疑度下降。两者叠加的结果是:人对「像不像本人」的主观判断,不能再作为高价值资金操作的授权依据。

IC3 给出的防护建议与企业化落地

IC3 在「Tips to protect yourself」中给出的建议包括:与家人约定一个用于验证身份的暗语或口令;留意图像与视频中的细微瑕疵,如变形的手脚、不真实的牙齿与眼睛、模糊或不规则的面部、不真实的眼镜首饰等配饰、错误的阴影、水印、延迟、口型与声音是否匹配以及不自然的动作;仔细聆听语调与用词以区分真实来电与 AI 生成的声音克隆;尽可能减少本人影像与声音的在线公开内容,将社交账号设为私密并限制关注者;通过挂断电话、自行查证银行或机构的联系方式并直接拨打该号码来核实来电者身份;绝不与仅在线上或电话中认识的人分享敏感信息;不向此类对象汇款或转移礼品卡、加密货币等资产。

企业化落地时,可把上述个人建议转译为制度:一是把验证从「人」搬到「流程」——付款账户变更走独立工单系统与预留联系人,不接受由邮件、电话或视频会议单独授权;二是回拨制——只使用主数据中预先登记的号码回拨,绝不使用来信或来电中提供的号码;三是双人复核与金额阈值——超过阈值的付款与账户变更强制双人分别确认;四是约定带外口令——对高管与财务岗设置周期轮换的口令短语,用于紧急场景;五是把「视频里见到本人」明确写为不构成授权证据并纳入员工培训。技术侧则继续强化 DMARC 强制策略、外部发件人标识、近似域监测、抗钓鱼 MFA 与邮箱转发规则审计,压缩攻击者取得邮件立足点的机会。

参考:FBI Internet Crime Complaint Center(IC3)《Criminals Use Generative Artificial Intelligence to Facilitate Financial Fraud》,Public Service Announcement,2024 年 12 月 3 日,https://www.ic3.gov/PSA/2024/PSA241203 ;NIST AI 600-1《Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile》,2024 年 7 月 26 日,DOI 10.6028/NIST.AI.600-1