AI语音诈骗:退休老人因合成女儿哭声被骗1.5万美元

Hacker News 热门(buzzing.cc 中文翻译)·2026-07-16 00:25·68天前·dxs
AI 导读

2025年夏季,美国佛罗里达州一名退休老人接到“女儿”哭诉车祸需保释金的电话,一小时内取现1.5万美元交给冒充法院的快递员——实际上,哭声是从一段音频片段合成的AI语音。FBI 2026年4月报告首次将AI欺诈列为独立类别,2025年收到超2.2万起AI相关投诉,调整后损失超8.93亿美元,其中60岁以上受害者占3.52亿美元。

Hacker News 热门(buzzing.cc 中文翻译)
精选
72AI 编辑部评分,满分 100

AI语音诈骗:退休老人因合成女儿哭声被骗1.5万美元

2026-07-16 00:25· 68天前· dxs
AI 导读

2025年夏季,美国佛罗里达州一名退休老人接到“女儿”哭诉车祸需保释金的电话,一小时内取现1.5万美元交给冒充法院的快递员——实际上,哭声是从一段音频片段合成的AI语音。FBI 2026年4月报告首次将AI欺诈列为独立类别,2025年收到超2.2万起AI相关投诉,调整后损失超8.93亿美元,其中60岁以上受害者占3.52亿美元。

推荐理由

FBI首次将AI诈骗单独统计,老年人成最大受害群体。这篇分析点破了防范盲区:别再指望靠人分辨真假语音,责任该压在银行和平台身上。

正文 · AI 翻译

三秒钟的盗窃:为什么 AI 语音诈骗跑赢了所有防御手段

Sharon Brightwell 听到电话那头传来女儿的哭声,那一刻,她可能构筑的任何防线都崩塌了。那声音属于 April,至少每一种本能都这样坚称:同样的音色,同样是一个身处困境的年轻女子那种断续的节奏。那声音说她一边开车一边发短信,撞上了一名孕妇,手机被警方扣了。

随后一名男子接过电话,自称是 April 的律师,解释说保释需要一万五千美元现金。他警告 Brightwell 不要告诉银行这笔钱的用途,因为这可能会损害她女儿的信用。不到一个小时,这位来自佛罗里达州多佛的退休老人就取出了钱,交给了一名她以为与法院有关的快递员。

直到她联系上真正的 April——她整个上午都在上班,从未靠近过任何车祸现场——她才明白,那通电话并不是她女儿打的。根本不是人打的。那哭声是从一段音频片段合成出来的,她以为自己正在营救的女儿,只存在于别人机器里的一串数字模式之中。

Brightwell 的损失,在 2025 年夏天被美国各地的地方新闻报道,如今已成为美国最普通不过的犯罪之一。它同时也是技术含量最高的犯罪之一。这两个事实的碰撞——一场需要机器学习绝对前沿技术的诈骗,竟能针对一位在自家厨房里的普通祖母,大规模实施,且成本几乎为零——正是执法部门、银行、电信公司和监管机构两年来始终未能遏制的一个问题的核心特征。

问题已不再是这项技术是否管用。它管用得出奇地好。问题是,当攻击的精密度与目标人群的认知之间的差距不是以月计而是以年计时,有意义的防护究竟需要什么。

一本二十六年账本中的新增一行

2026 年 4 月,FBI 的互联网犯罪投诉中心发布了关于上一年网络犯罪的年度报告,在这份报告二十六年来的历史中,首次将人工智能驱动的诈骗作为一个独立类别单独列出。数字触目惊心。该局记录了超过 22,000 起与 AI 相关的投诉,调整后损失超过 8.93 亿美元。

其中,报告将 3.52 亿美元的损失归因于 60 岁及以上的受害者,使老年人成为 AI 驱动的金融犯罪中受 targeting 最严重的人群。AI 相关数字置身于一个远为庞大的总量之中:全美网络犯罪损失在一年内上升了 26%,达到 209 亿美元,其中 60 岁及以上的美国人占了 77 亿美元——较上一年跃升约 60%。

FBI 坦承,即便是这些数字也低估了问题的严重性。报告中对 AI 的归因只反映了受害者识别并报案的部分,而大多数克隆语音电话的受害者根本无从得知背后有机器参与。他们相信——正如 Sharon Brightwell 起初也相信的那样——自己是在和自己的亲生孩子说话。

因此,8.93 亿美元最好被理解为一个下限,而非上限——它只是这个类别中可见的那一部分,而这类骗局在本质上就是设计成对受害者保持隐形的。FBI 竟然觉得有必要专门设立这一类别,这本身就是一种信号。犯罪统计数据向来是保守的工具;机构不会为了一时的风潮去重新划定沿用二十六年的报案分类体系。

账本上新增的这一行,等于承认了一种三年前在消费级形态下几乎不存在的工具,如今已成为主流的盗窃手段。

在国际层面,情况更为庞大且持续恶化。2026 年 3 月,INTERPOL 发布了第二版《全球金融欺诈威胁评估》,估计 2025 年全球金融欺诈损失达 4420 亿美元——这一数额相当于丹麦全年的经济产出。该组织将威胁趋势评定为不断升级,并描述了其所称的“欺诈工业化”:诈骗从机会主义的个体行为,演变为有组织的跨国运作,并与人口贩运和网络犯罪相互交织。

关键在于,INTERPOL 发现,AI 增强型欺诈的获利能力大约是传统欺诈的四倍半,而且所谓的智能体 AI 系统如今能够自主策划并执行完整的欺诈行动,从前期侦察一直到勒索赎金。换言之,经济逻辑已经反转。工业化规模的欺骗行为,首次变得几乎零成本制造,却能带来巨额回报。

三秒足矣

祖父母诈骗的核心技术能力,描述起来简单得近乎残酷。一套现代 AI 语音克隆系统只需短短三秒音频,就能生成一段合成语音,在实际效果上与真人原声几乎无法区分。三秒,不过是一条语音留言问候的长度,一段播客的片段,或是发布在公开 Instagram 账号上的生日视频里的音频。

这些原材料并非从安全数据库中窃取,而是人们日复一日通过记录生活的寻常行为主动交出的。一个仅在一段 TikTok 短视频中露过面的孙辈,就已经为诈骗者提供了制造其自导自演绑架案所需的一切。

让这一威胁变得尤为严峻的,不仅是克隆技术本身可行,更在于实现克隆的工具廉价、泛滥,且几乎完全不受监管。2025 年 3 月,Consumer Reports 评估了六家公司——Descript、ElevenLabs、Lovo、PlayHT、Resemble AI 和 Speechify——的语音克隆产品,结论是其中大多数缺乏任何有意义的防欺诈或防滥用保障措施。

该组织发现,其中四款产品仅要求用户勾选一个复选框,声明自己拥有克隆相关语音的合法权利。这四款产品中,没有任何一款采用技术机制来确认说话者是否真正同意,也没有任何一款将克隆限制在用户本人的声音范围内。六家公司中有四家仅需一个姓名或一个电子邮箱地址即可开设账户。

这项调查得出的直白结论——经 NBC News 和 The Register 放大传播——是:这个行业造出了一款能够冒充任何人的工具,然后把它放在一个自我声明的复选框后面。

ElevenLabs 是最知名的提供商之一,它指出了一套多层安全方案:一项禁止冒用他人身份的使用政策、一个公开的 AI 语音分类器(可识别很可能源自其系统的音频)、可将生成内容追溯回制作它的账户的可追溯机制,以及在选举周期前后阻止克隆某些受保护人物的“禁区声音”保障措施。

这些并非无足轻重的举措,而且比若干竞争对手提供的还要多。但它们有一个共同的结构性弱点:几乎所有这些措施都是在事后才发挥作用。它们能帮助调查人员在欺诈已经发生、受害者已经损失积蓄之后确定来源。它们对于从一开始就阻止那三秒克隆音频被生成几乎毫无作用,因为真正能阻止它的东西——对被克隆者已表示同意的强有力、强制性验证——恰恰是一个竞争激烈、快速变化的市场不愿强加于自身的那种摩擦。

当一项保障措施会损害公司的转化率、却只保护竞争对手的客户时,市场不会自愿提供它。事实也确实没有。

失明的取证权威

如果说有哪一个瞬间能说明为什么基于检测的防御正在失效,那便是《纽约时报》于 2026 年 6 月刊登的一篇人物特写。报道的主角是 Hany Farid,加州大学伯克利分校教授,被广泛公认为全球深度伪造取证领域的头号权威。

二十多年来,Farid 凭借辨别真实与合成内容的能力建立了自己的职业生涯,承接来自政府、人权组织、记者和执法部门的请求。据《纽约时报》报道,近来他开始无法通过自己的测试。“我觉得自己正在失明,”他说。地球上最有能力分辨真实录音与 AI 生成录音的人,再也无法可靠地做到这一点。

这一坦白理应终结某一类讨论。多年来,针对合成媒体的应对措施所隐含的承诺一直是:检测会与生成保持同步——每出现一个更逼真的伪造品,就会有一个更灵敏的检测器,而这场军备竞赛虽然令人不安,至少是可以打赢的。Farid 的坦白证明,至少在音频领域,这场竞赛已经输了。

当该领域最顶尖的检测器退化到如同掷硬币,在伪造品被制造并传播之后再将其抓出的策略就根本算不上策略。它只是一种希望。而一场依赖二十分钟恐慌的诈骗,不会给受害者或其银行留下二十分钟去跑一遍连 Hany Farid 都不再信任的取证分析。

这是有意义的防护要求我们接受的第一件、也是最重要的一件事:检测不能成为承重的防线。一位接到电话、听到泣不成声的祖母,不能指望她去完成连该领域顶尖专家都已实质上放弃的取证分析。任何最终依赖于目标对象或任何其他人能够分辨真实声音与克隆声音的方案,都已经过时了。

其影响远不止电话诈骗。如果世界上合成音频检测领域的权威都无法信任自己的判断,那么每一个默默假设人类可以作为兜底验证者的下游系统——被要求"自行斟酌"的银行柜员、被催促"仔细听有没有哪里不对劲"的亲属——都建立在一个早已崩塌的基础之上。

脆弱性的架构

将老年人作为目标归因于天真,这种想法既诱人又错误。促成这篇文章的简报揭示了一个更令人不安的真相:使老年人格外脆弱的那些特征,并非智力上的缺陷,而是一生好好生活所留下的印记。他们往往拥有更高的平均储蓄余额,这是数十年工作积累的产物,这使他们成为高效的目标——一次成功的通话所能带来的收益,远远超过针对年轻人的一次通话。

他们成长于、并且至今仍运作于基于信任的既定沟通模式之中,在这种模式里,来自一位陷入困境的亲属的电话会被当作真实的紧急情况来回应,而不是被当作潜在攻击来审视。他们并非自己的过错,却相对不熟悉 AI 语音合成的存在,因为他们一生中大部分时间所处的世界里,电话那头的声音按定义就是电话那头的人。

而且,像每一位父母和祖父母一样,他们也暴露在家庭紧急情况这一特定情感架构之下——在这种情境中,保护孩子的本能会压倒一切更缓慢、更具怀疑精神的官能。

学术研究已开始将这一现象正式化。2026 年 6 月发表的一篇 arXiv 论文直言不讳地指出,“老年人仍然不成比例地容易受到 AI 增强型诈骗的侵害。”另一项由 Yixin Zou 领导的团队开展、同样于 2026 年初发表的研究,考察了在 AI 日益复杂化背景下专为老年人设计的欺诈干预措施,开发了一款名为 ROLESafe 的基于角色的模拟工具,该工具让参与者通过扮演受害者或帮助者的角色来学习,而非被动观察,从而提升了他们识别欺诈的能力。

还有第三篇论文,来自 Charm Security 公司的研究人员,提出了一个“人类脆弱性与利用框架”——一个结构化的目录,仿照软件安全领域的漏洞数据库,用于对欺诈系统所利用的认知和社会机制进行分类。该框架的前提本身就是一种无声的控诉:安全行业花费了数十年对机器的弱点进行编目和修补,却让人的弱点始终未被记录、未被管理。

祖父母诈骗之所以得逞,是因为它攻击的是系统中从未有人为其编写过补丁的那一部分。

这正是为什么针对老年人的宣传活动虽然必要,却远远不够。骗局所利用的情感机制,并不是一份传单就能填补的知识空白;它是某个人对孙辈的爱,被武器化了。你可以一百遍地告诉一个人声音可以被伪造,但当克隆的声音尖叫着求救的那一刻,这份知识不会及时到来。

2026 年 6 月,《海峡时报》和《马尼拉时报》转载的法新社通讯稿引用了语音安全公司 Pindrop 的阿米特·古普塔对此事的精准概括:“目标不是完美的声音复制。目标是制造足够的情感不确定性和紧迫感,让受害者在核实之前就采取行动。”

一种建立在“受害者会去核实”这一假设之上的防御,恰恰是针对攻击所设计绕过的那个弱点而建立的防御。

那篇通讯稿中最令人不寒而栗的证词并非来自一位年长的受害者,而是来自一位律师。加里·希尔德霍恩是费城的一名律师,他本人就曾是克隆声音骗局的目标,他说即便事后回想、带着职业性的怀疑,他也无法摆脱自己所听到之物的那种确定性:“我会到死都发誓那是你的声音。”

任何倾向于相信警惕就是答案的人,都应该读一读这句话。希尔德霍恩是一位受过训练的辩护人,他的职责就是审视证据、不相信看似合理的故事,而克隆声音击败他的彻底程度,与击败一位惊慌失措的祖母别无二致。这一骗局所利用的脆弱性,并不仅仅存在于老年人、轻信者或技术文盲身上。

它存在于人类听觉系统本身——这个系统经过数千年的演化,将识别出的声音视为识别出的人的证明——而如今,在这漫长历史中第一次,它系统性地、可被利用地出错了。

关于老年人的数据支持而非反驳这一重新框定。FTC 在 2025 年 12 月提交国会的报告发现,60 岁及以上人群报告的欺诈损失总额在 2020 年至 2024 年间大约翻了两番,达到约 24 亿美元,其中 68% 归因于单笔 10 万美元或以上的个人损失。

该机构自己对真实年度成本的估算——考虑到羞耻和尴尬必然导致的长期低报——高达 815 亿美元。这些数字不属于一个轻信的少数群体被一点点骗走零花钱的情形。这些数字属于一代人积累的储蓄,正通过一种专门针对他们的信任模式、财务状况以及他们在家庭情感中心位置而精心调校的机制被榨干。

不对称性,量化呈现

安全公司 Adaptive Security 的首席执行官 Brian Long 用一句话为 AFP 提炼了这种新经济逻辑:“一个人待在一个房间里,有一块键盘,就能制造出无限多的攻击者。”这就是最纯粹形式的不对称。一边是一个自动化系统,能在几秒内生成一个以假乱真的克隆,拨打数千个号码,用合成情感进行每一次对话,而边际成本趋近于零。

另一边是一个个体的人,往往是老年人,孤独一人,只有大约一通惊慌失措的电话的时间来组织防御——而这是世界上最顶尖的法医科学家都无法做到的。

国际刑警组织发现,AI 增强型诈骗的获利能力是传统诈骗的四倍半,这正是这种失衡在财务层面的体现。当一次攻击既变得更廉价、又变得更有利可图时,攻击的数量不会线性增长,而是会爆炸式增长。美国网络犯罪损失在单一年份跃升 26%,六十岁以上人群的损失几乎翻倍,这就是那场爆炸在一国账本上的样子。

而法新社的报道还指出了另一点加剧伤害的因素:羞耻感。布法罗的母亲 Liz Benz 曾经历她所称的“足足二十分钟的恐惧”——一个克隆声音告诉她,她十六岁的儿子被绑架了——她说,在她公开此事之后,其他受害者的信息如潮水般涌来,其中许多人选择匿名,因为被骗的羞辱让他们保持沉默。

在此,低报并不是一个统计脚注。它是一种结构性特征:这种犯罪被设计成让受害者觉得自己太愚蠢而不愿站出来,而这反过来又让数据、起诉和政策应对失去了它们所需的证据。一种能让自己的证人噤声的犯罪,是一种会以复利不断累积的犯罪。

为什么这一负担不能落在家庭身上

在整个 2026 年,被 FBI、美国银行家协会和消费者权益倡导者反复传播的一条最广为流传的建议,是约定一个家庭“安全词”——一个只有亲属知道的秘密短语,在任何紧急来电中都要被要求说出。如果对方的声音说不出它,就挂断,并用已知号码回拨。这条建议是合理的。但作为一种系统性防御,它也极其不够,值得把原因说清楚。

安全词只有在家庭的每一位成员都采用它、记住它,并且在那个被精心设计来摧毁冷静判断力的时刻仍有镇定去要求对方说出它时,才会奏效。它把击败一个工业化、自动化、耗资数十亿美元的犯罪机器的全部重担,压在了一个惊恐万分的个体在其一周中最糟糕时刻的认知自律上。

它假定那位八十岁的老人——根据 FTC 于 2025 年底发布的数据,其报告损失的中位数超过 1600 美元——在听到孙辈尖叫的同时,还能冷静地回忆起一套协议并加以执行。有些人做得到。而许多人,从设计上就注定做不到。一种只有在目标于极限压力下表现完美时才奏效的防御,不是防御;它是一种事后把责任归咎于受害者的方式。

这是对把保护交到家庭和个人手中更深层的反对理由。它把技术和金融系统失灵的责任,转嫁到最无力承担的人身上,然后当他们失败时,又把他们的失败当作个人失败来对待。声音克隆工具是由公司制造并销售的。通话是由电信网络承载的。资金是通过银行流转的。

这些各方都运营在那些本可以大规模拦截诈骗的关键节点上。而在厨房里的那位祖母并不掌握这些节点。有意义的保护要求把负担从链条的末端——它目前所在的位置——转移到它本该属于的中间环节。一个面对工业化威胁却只是向其最脆弱的成员发布更好建议的社会,已经把发布指南与提供保护混为一谈。

拦截真正可能发生的地方

接下来依次考察这三个制度性瓶颈,因为每一个都既体现了结构性防御的前景,也暴露了它当下的失败。

第一个是电话网络。在美国,STIR/SHAKEN 框架本意是解决来电显示欺骗问题,它允许发端运营商对通话进行加密签名以证明其合法性,并让终端运营商在通话到达手机之前验证该签名。2025 年 12 月,FCC 有线竞争局在其三年一度的有效性报告中得出结论:该框架在正确应用时确实能有效验证来电显示。

这个限定条件承担着极其重要的作用。犯罪分子很早就发现,通过较老的非 IP 网络路由通话可以完全绕过该系统,而 FCC 在 2025 年和 2026 年的大部分时间里都在试图堵上这一漏洞,并推动 Rich Call Data,即在手机上显示经过验证的来电者姓名和标志。

但 STIR/SHAKEN 验证的是号码,不是人,更不是声音。它能告诉你一通电话确实来自某条线路。它无法告诉你那条线路上哭泣的女儿是一台机器。面对来自伪造号码或仅仅是陌生号码的克隆声音,这套框架几乎毫无用处。同一个 FCC 在 2024 年 2 月宣布,根据《电话消费者保护法》,机器人电话中由 AI 生成的声音是非法的——这是一份有意义的意向声明,但它只管束大规模自动拨号,而管不到定义"祖父母骗局"的那种有针对性的、一对一的紧急电话。

第二个瓶颈是承载克隆工具的平台。在这里,最有前景的结构性干预手段是来源溯源而非检测——这一尝试体现在 C2PA 标准中,旨在为一段媒体附加一份防篡改的加密记录,描述生成它的设备或模型。2025 年,该标准被批准为 ISO 规范,并与 Google 的 SynthID、Meta 的 AudioSeal 等水印方案一道,成为互联网事实上的来源溯源语言。

其逻辑是合理的:与其追问一段录音看起来或听起来是否伪造,不如追问它是否携带了证明其由真实麦克风录制的凭证。但针对这一特定犯罪,来源溯源自身存在一个致命的不对称性。缺失凭证并不能证明是伪造,因为大量合法音频从未被签名,而且元数据经常被社交平台、截图和重新编码所剥离。

更根本的是,一个拨打诈骗电话的骗子没有任何义务传输 C2PA 清单,而模拟信号缺口——通过电话线播放合成音频——在传输过程中就会摧毁任何数字水印。来源溯源可以在事后帮助确认一段病毒式传播的视频是合成的。但对于正在进行的实时克隆语音通话,它几乎无能为力。

第三个卡点——也是最有希望的一个——是银行。这里是资金真正流动的地方,因此也是拦截在机制上最具杠杆效应之处。英国提供了最清晰的自然实验。2024 年 10 月,支付系统监管机构(Payment Systems Regulator)将授权推送支付欺诈的赔付设为强制要求:当受害者被诱骗授权向诈骗者转账时,转出银行和接收银行现在必须向其赔付,双方各承担一半责任,最高 85,000 英镑,须在五个工作日内完成,且对弱势客户明确禁止适用消费者过失例外条款。

账户名称核查服务 Confirmation of Payee 如今已运行于数十亿笔交易之上。PSR 自己的仪表盘显示,在截至 2025 年 12 月底的十五个月里,此类诈骗造成的资金损失中,有 89%——约 2.43 亿英镑——获得了赔付,而规则生效前这一比例为 65%。

强制赔付的意义不仅仅在于让受害者得到完整补偿,尽管这一点很重要。它更深层的目的是重新定位经济激励。一旦银行对损失负有责任,它们就有了强大的动力去构建那些真正能在欺诈转账完成之前将其阻止的摩擦机制、异常检测和干预协议——暂缓支付、对老年客户大额取现设置冷静期、由支行人工致电询问为什么一位退休老人突然要把她的积蓄全部转给一个快递员。

一位老奶奶无法对自己施加的转账摩擦,银行可以对她的账户施加,而责任制度给了银行这样做的理由。批评者,包括《Electronic Payments International》的评论员,警告说如果不与预防措施相配合,仅靠赔付有可能变成对欺诈者的补贴,而且这一策略必须超越仅仅向受害者退款。

这一批评是正确的,它指向的是正确答案而非偏离答案:责任是迫使预防发生的杠杆,而不是预防的替代品。英国实验的教训不是赔付能解决欺诈——它不能——而是它改变了欺诈是谁的问题,而一个被迫承担某个问题的机构,最终会设计出针对该问题的解决方案。

真正有意义的保护究竟需要什么

把这些线索串联起来,就能勾勒出一幅清晰的图景,说明什么才是真正有效的,而非仅仅听起来令人安心。

这首先要求放弃将检测作为主要防线。Hany Farid 的盲区并非一个靠更好的分类器就能解决的暂时性挫折;它是这样一个世界的永久结构性状况:在这个世界里,生成已经跑赢了辨别。任何最终保障措施是寄望于某个人、在某个地方分辨真假的做法,都已经失败了。

这其次要求对武器的供应进行监管。《消费者报告》发现语音克隆工具仅靠一个自我声明的勾选框来把关,这是一种政策选择,而非自然法则。在克隆某人的声音之前强制要求可验证的同意——Descript 和 Resemble AI 已部分实现,而其他公司尚未做到——在技术上可行,且不会废除该技术的正当用途。

欧盟的《人工智能法案》,其对通用目的模型的义务已于 2025 年和 2026 年陆续开始适用,以及田纳西州的 ELVIS 法案等州法规——该法案要求克隆声音须获得书面同意——都是将语音合成视为其已然成为的受监管能力的早期姿态。

它们仍远远领先于执法,又远远落后于威胁。

第三,它要求把拦截的责任压到占据咽喉要道的机构身上——而在它们不愿主动作为的地方,通过法律责任强制其行动。英国的分担赔偿制度并不完美、也不完整,但它展示了这一机制:当银行承担损失时,银行就会构建摩擦。从转接电话中获利的电信运营商,应当承担相应的义务去验证来电,并在可能的情况下对其加以标记。

销售克隆技术的平台,应当承担核实同意的义务。共同的原则是:责任应当落在既有能力防止伤害、又从造成伤害的活动中获取商业利益的一方身上——而在每一种情况下,这一方都是某个机构,在任何情况下都不是一位接电话的八十岁老人。

第四,它要求把人的脆弱性当作一件需要管理的事,而不是一件需要被指责的事。Charm Security 框架的洞见——欺诈所利用的认知与情感机制,值得像软件缺陷一样被系统地编目——应当指导银行如何设计其干预措施,指导运营商如何设计其警告,指导公共机构如何设计教育:这种教育要超越传单,达到 ROLESafe 研究发现真正能改变行为的那种基于角色的演练。

宣传活动和家庭安全暗语并非毫无价值。它们只是最后、也最薄弱的一道防线,仅作为承担真正工作的结构性防御的兜底而有用。

防御差距以年而非月来衡量,其最深层的根源在于:攻击是一个技术问题,而防御是一个制度问题。克隆一段声音只需三秒,而且每月都在进步。而通过一项报销法规、重构一家银行系统的欺诈控制、在一个行业内强制实施同意验证、堵上国家电话网络中非 IP 的漏洞,都需要数年时间,因为它们需要法律、协调、资金,以及克服每一个从现状中获利的商业利益。这种不对称不仅仅是技术上的;它是机器能被建造出来的速度与社会能作出回应的速度之间的不对称。

Sharon Brightwell 最终拿回了一部分钱,靠的是调查人员和她的银行的尽职努力。许多人则拿不回来。FBI 归因于 AI 欺诈老年受害者的 3.52 亿美元,以及它无法看到的远大于此的金额,代表着一种财富转移——从最承受不起损失的人,转移到迄今所设计出的最高效的犯罪产业。

弥合这一差距,不会靠教祖母们去怀疑孙辈声音的真伪。它将来自以法律和工程为准绳作出决定:站在克隆声音与现金之间的那些机构,应对经手之物负责。在这一决定作出之前,这场三秒盗窃仍将是世界上最容易实施的重罪,也是受害者最难被相信的重罪——因为那些证据,从设计上听起来,恰恰就像他们所爱的某个人。

参考文献

  1. 美国联邦调查局,《加密货币与 AI 诈骗令美国人损失数十亿美元》,2026 年 4 月。https://www.fbi.gov/news/press-releases/cryptocurrency-and-ai-scams-bilk-americans-of-billions
  2. 互联网犯罪投诉中心(FBI),《2025 年 IC3 年度报告》,2026 年 4 月。https://www.ic3.gov/AnnualReport/Reports/2025_IC3Report.pdf
  3. ABA Banking Journal,《FBI:2025 年网络犯罪损失增长 26%》,2026 年 4 月。https://bankingjournal.aba.com/2026/04/fbi-cybercrime-losses-increased-26-in-2025/
  4. SecureWorld,《FBI:2025 年 AI 驱动的欺诈金额突破 8.93 亿美元——实际损失可能远高于此》,2026 年 4 月。https://www.secureworld.io/industry-news/ai-enabled-fraud-topped-893m-fbi
  5. AARP,《2025 年老年人遭受欺诈重创》,2026 年 4 月。https://www.aarp.org/money/scams-fraud/fbi-ftc-report-2025-losses/
  6. HousingWire,《FBI:2025 年老年人因网络犯罪损失 77.5 亿美元——激增 59%》,2026 年 4 月。https://www.housingwire.com/articles/fbi-seniors-cybercrime-2025/
  7. INTERPOL,《INTERPOL 报告警告全球金融欺诈威胁日益复杂精密》,2026 年 3 月。https://www.interpol.int/en/News-and-Events/News/2026/INTERPOL-report-warns-of-increasingly-sophisticated-global-financial-fraud-threat
  8. Help Net Security,《全球欺诈损失攀升至 4420 亿美元》,2026 年 3 月 18 日。https://www.helpnetsecurity.com/2026/03/18/online-fraud-victims-losses-interpol-report/
  9. ICLG,《国际刑警组织警告全球欺诈正走向"工业化"》,2026 年 3 月。https://iclg.com/news/23665-interpol-warns-of-industrialisation-of-global-fraud
  10. 《纽约时报》,《在 AI 时代,全球顶尖的深度伪造专家不再相信自己的眼睛》,2026 年 6 月。(经由 beSpacific 报道。)https://www.bespacific.com/the-worlds-leading-deepfake-expert-no-longer-trusts-his-own-eyes/
  11. FOX 13 Tampa Bay,《多佛一名女子在诈骗者利用人工智能冒充其女儿后损失 1.5 万美元》,2025 年 7 月。https://www.fox13news.com/news/dover-woman-loses-15k-after-scammers-used-artificial-intelligence-impersonate-daughter
  12. 法新社(经由《马尼拉时报》),《"20 分钟的恐怖":AI 助推美国语音冒充诈骗》,2026 年 6 月 4 日。https://www.manilatimes.net/2026/06/04/news/world/20-minutes-of-terror-ai-boosts-us-voice-impersonation-scams/2358259
  13. 《消费者报告》,《消费者报告对 AI 语音克隆产品的评估》,2025 年 3 月。https://www.consumerreports.org/media-room/press-releases/2025/03/consumer-reports-assessment-of-ai-voice-cloning-products/
  14. NBC News,《AI 能窃取你的声音,而你几乎无能为力》,2025 年 3 月。https://www.nbcnews.com/tech/security/ai-voice-cloning-software-flimsy-guardrails-report-finds-rcna195131
  15. The Register,《Consumer Reports 指出 AI 语音克隆防护措施薄弱》,2025 年 3 月 10 日。https://www.theregister.com/2025/03/10/ai_voice_cloning_safeguards/
  16. ElevenLabs,《安全》,2026 年。https://elevenlabs.io/safety
  17. Ben, A., Rahav, T., Illaev, D., Nahon, A. 和 Grushka, A.(Charm Security),《人类脆弱性与漏洞利用(HVE)框架》,arXiv:2606.10083,2026 年 6 月。https://arxiv.org/abs/2606.10083
  18. Deng, Y., Chen, X., Liao, J., Li, B. 和 Zou, Y.,《经历者、帮助者还是旁观者:基于角色模拟的老年人网络诈骗干预》,arXiv:2601.12324,2026 年 1 月。https://arxiv.org/abs/2601.12324
  19. 美国联邦通信委员会,《FCC 将机器人电话中的 AI 生成语音定为非法》,2024 年 2 月。https://www.fcc.gov/document/fcc-makes-ai-generated-voices-robocalls-illegal
  20. 美国联邦通信委员会,《通过主叫号码认证(STIR/SHAKEN)打击伪造机器人电话》,2026 年更新。https://www.fcc.gov/call-authentication
  21. EyeSift,《C2PA 深度伪造检测 2026:AI 图像水印与 SynthID》,2026 年。https://www.eyesift.com/ai-image-detection-2026-c2pa-content-credentials-synthid-watermarks-diffusion-fingerprints-deepfake/
  22. 支付系统监管局,《PS25/5 综合政策声明:APP 诈骗赔付要求》,2025 年 5 月。https://www.psr.org.uk/media/rhelv4op/ps25-5-app-scams-reimbursement-consolidated-policy-statement-may-2025.pdf
  23. 《国际电子支付》,"为什么英国的诈骗治理策略必须超越赔付",2025 年。https://www.electronicpaymentsinternational.com/comment/why-uk-scam-strategy-must-move-beyond-reimbursement/
  24. 美国联邦贸易委员会,《保护老年消费者 2024–2025:美国联邦贸易委员会报告》,2025 年 12 月。https://www.ftc.gov/system/files/ftc_gov/pdf/P144400-OlderAdultsReportDec2025.pdf
  25. 美国律师协会,《AI 克隆语音诈骗的兴起》,2025 年 9 月。https://www.americanbar.org/groups/senior_lawyers/resources/voice-of-experience/2025-september/ai-cloned-voice-scam/

来源:Hacker News 热门(buzzing.cc 中文翻译)· smarterarticles.co.uk