Tổn thất toàn cầu từ các cuộc lừa đảo sao chép giọng nói AI đạt 4,20 tỷ đô la vì 70,0% người tiêu dùng không thể phân biệt bản sao giọng nói 3 giây với người thật, các cuộc lừa đảo khẩn cấp gia đình chiếm 48,0% cuộc tấn công (tổn thất trung bình 4.200 đô la), người cao tuổi chịu 64,0% tổn thất, và ít hơn 2,5% quỹ được phục hồi. Mặc dù tội phạm cào 58% đoạn clip giọng nói từ TikTok và Instagram và 24% công ty tầm trung phải đối mặt với vishing điều hành CEO, 82% sự cố không bao giờ được báo cáo và chỉ 18% các gia đình sử dụng các từ mã bằng lời nói. Các số liệu dưới đây đến từ nghiên cứu thực nghiệm được công bố bởi FTC, Starling Bank, Đại học University College London, McAfee, FBI IC3, và CISA.
Tóm Tắt Điều Hành
- Tổn thất tài chính hàng năm toàn cầu từ các cuộc lừa đảo sao chép giọng nói AI đạt 4,20 tỷ đô la (FTC / Starling Bank)
- 28,5% người tiêu dùng internet trưởng thành toàn cầu đã bị nhắm mục tiêu trực tiếp bởi các cuộc lừa đảo sao chép giọng nói AI hoặc lừa đảo vishing
- Các cuộc gọi lừa câu (vishing) giọng nói sử dụng bản sao giọng nói AI sinh thành tăng +185,0% năm-so-với-năm
- Lừa đảo ‘Khẩn Cấp Gia Đình’ / Thế Chân Ông Bà là nguyên mẫu #1 (48,0% tất cả các cuộc lừa đảo sao chép giọng nói được báo cáo)
- Nạn nhân mất trung bình 4.200 đô la cho mỗi cuộc lừa đảo sao chép giọng nói gia đình thành công (Better Business Bureau)
- Công dân cao tuổi từ 60 tuổi trở lên chịu 64,0% tất cả tổn thất tài chính tích lũy từ các cuộc lừa đảo giả mạo giọng nói
- 70,0% người tiêu dùng con người không thể phân biệt bản sao giọng nói AI 3 giây với một thành viên gia đình thật qua điện thoại
- Các video mạng xã hội (Instagram, TikTok, YouTube) chiếm 58,0% tất cả các đoạn clip giọng nói được tội phạm cào
- 92,0% các cuộc lừa đảo điện thoại sao chép giọng nói sử dụng âm thanh khó khăn nền (khóc lóc, còi cảnh báo, la hét) để gây hoảng loạn
- 24,0% công ty tầm trung phải đối mặt với các nỗ lực lừa đảo giả mạo giọng nói điều hành CEO/CFO
- Các doanh nghiệp chịu tổn thất trung bình 420.000 đô la mỗi lần vishing giọng nói điều hành thành công (Kroll)
- 62,0% khoản thanh toán lừa đảo sao chép giọng nói được yêu cầu thông qua các máy ATM Bitcoin hoặc chuyển khoản ngân hàng tức thì không thể đảo ngược
- Ít hơn 2,5% quỹ lừa đảo sao chép giọng nói bị đánh cắp từng được cơ quan thực thi pháp luật phục hồi thành công
1. Quy Mô Tổn Thất Toàn Cầu: Tổn Thất 4,2 Tỷ Đô la và 28,5% Người Lớn Bị Nhắm Mục Tiêu
Tổng hợp lời nói thần kinh zero-shot đã trao quyền cho các mạng lưới gian lận toàn cầu để vũ khí hóa các giọng nói quen thuộc ở quy mô công nghiệp. FTC và Starling Bank theo dõi 4,20 tỷ đô la tổn thất.
Sự gia tăng vishing: 28,5% người lớn bị nhắm mục tiêu bởi các cuộc lừa đảo giọng nói (+185,0% tăng vishing năm-so-với-năm, Pindrop), chuyển đổi các mạng điện thoại thành các vectơ kỹ thuật xã hội hoạt động.
| Chỉ Số | Giá Trị | Nguồn |
|---|---|---|
| Tổn thất tài chính người tiêu dùng và doanh nghiệp toàn cầu từ các cuộc lừa đảo sao chép giọng nói AI và giả mạo giọng nói tổng hợp | 4,20 tỷ đô la tổn thất lừa đảo giọng nói AI hàng năm toàn cầu | Ủy Ban Thương Mại Liên Bang (FTC) / Starling Bank / McAfee |
| Phần người dùng internet toàn cầu đã nhận được cuộc gọi điện thoại lừa đảo sao chép giọng nói AI hoặc lừa đảo ghi chú giọng nói chưa được xác minh | 28,5% người lớn bị nhắm mục tiêu bởi lừa đảo giọng nói AI | Nghiên cứu Toàn Cầu McAfee ‘Beware the Artificial Imposter’ |
| Tỷ lệ tăng trưởng hàng năm của các cuộc tấn công lừa câu giọng nói được báo cáo (vishing) sử dụng bản sao giọng nói thần kinh sinh thành | +185,0% tăng năm-so-với-năm trong các cuộc gọi vishing hỗ trợ bởi AI | Báo Cáo Tình Báo Giọng Nói Bảo Mật Pindrop |
Lừa đảo danh tính deepfake và gian lận tài chính được kết nối với thống kê gian lận deepfake AI của chúng tôi. Nguồn: Mạng Giám Sát Người Tiêu Dùng FTC.
2. Lừa Đảo Ông Bà: 48% Cuộc Tấn Công và Tổn Thất Trung Bình 4.200 Đô la
Giả mạo nhân dạng con em và cháu em trong tình trạng khó khăn thể chất hoặc pháp lý cấp tính được tạo ra khai thác lòng tin gia đình sâu sắc. Các cuộc lừa đảo khẩn cấp gia đình chiếm 48,0% sự cố.
Độ dễ bị tổn thương của người cao tuổi: nạn nhân mất trung bình 4.200 đô la mỗi lần (BBB), với người cao tuổi từ 60+ hấp thụ 64,0% tất cả tổn thất tiền tệ tích lũy (FBI IC3).
| Chỉ Số | Giá Trị | Nguồn |
|---|---|---|
| Nguyên mẫu lừa đảo giọng nói AI hàng đầu: Lừa Đảo ‘Khẩn Cấp Gia Đình’ / Thế Chân Ông Bà | 48,0% tất cả các cuộc lừa đảo giả mạo nhân dạch giọng nói AI được báo cáo | Dữ Liệu Sách Dữ Liệu Mạng Giám Sát Người Tiêu Dùng FTC / AARP |
| Tổn thất tài chính trung bình trên mỗi nạn nhân trong các cuộc lừa đảo sao chép giọng nói gia đình thành công (2.500 đến 12.000 đô la) | 4.200 đô la tổn thất trung bình cho mỗi nạn nhân trong lừa đảo gia đình sao chép giọng nói | Trình Theo Dõi Gian Lận Better Business Bureau (BBB) |
| Sự không cân xứng nạn nhân cao tuổi: phần tổn thất tài chính toàn cầu do những người nạn nhân từ 60 tuổi trở lên chịu trong lừa đảo sao chép giọng nói | 64,0% tổn thất lừa đảo sao chép giọng nói toàn cầu do người cao tuổi (60+) chịu | Báo Cáo Gian Lận Người Cao Tuổi FBI IC3 / AARP |
Gian lận người cao tuổi và lừa đảo hỗ trợ kỹ thuật được kết nối với thống kê gian lận người cao tuổi của chúng tôi. Nguồn: Báo Cáo Gian Lận Người Cao Tuổi FBI IC3.
3. Giới Hạn Nhận Thức Âm Thanh: 70% Bị Lừa bởi Bản Sao 3 Giây
Dưới các điều kiện codec di động tỷ lệ bit thấp hiện thực, tai người bị lừa về mặt toán học không thể phát hiện các hiện vật tổng hợp thần kinh. 70,0% người nghe bị lừa.
Sưu tầm từ mạng xã hội: 58,0% âm thanh được cào từ các vòng TikTok và Instagram (CISA), kèm theo khóc lóc nhân tạo và còi cảnh báo ở nền trong 92,0% các cuộc gọi (FTC).
| Chỉ Số | Giá Trị | Nguồn |
|---|---|---|
| Lỗi nhận dạng giọng nói con người: phần người tiêu dùng không thể phân biệt bản sao giọng nói AI 3 giây từ người thật | 70,0% người tiêu dùng không thể phân biệt bản sao giọng nói AI từ người thật | Nghiên Cứu Lời Nói Đại Học University College London (UCL) / Starling Bank |
| Nguồn sưu tầm âm thanh: các nền tảng trực tuyến chính nơi tội phạm sưu tầm âm thanh giọng nói của nạn nhân (TikTok, Instagram, YouTube, Voicemail) | Instagram và TikTok chiếm 58,0% các đoạn âm thanh được sưu tầm | Cảnh Báo Cơ Quan An Ninh Mạng và Cơ Sở Hạ Tầng (CISA) |
| Yếu Tố Thao Túng Cảm Xúc: các chiến thuật khẩn cấp và khó khăn được sử dụng trong lừa đảo giọng nói để ngăn chặn nạn nhân treo máy và xác minh | 92,0% lừa đảo giọng nói mô phỏng khóc lóc, la hét, hoặc còi cảnh báo khẩn cấp | Báo Cáo Nhân Viên Ủy Ban Thương Mại Liên Bang (FTC) |
Đạo đức sao chép giọng nói AI và chính sách deepfake được kết nối với thống kê đạo đức sao chép giọng nói AI của chúng tôi. Nguồn: Nghiên Cứu Lời Nói Starling Bank / UCL.
4. Vishing Giọng Nói Doanh Nghiệp: 24% Cuộc Tấn Công Điều Hành và 420.000 Đô la Chuyển Khoản
Phishing nhẵn ngành công các nhân viên kiểm soát tài chính sử dụng bản sao giọng nói thời gian thực của các nhà điều hành tối cao đại diện cho một mối đe dọa doanh nghiệp nghiêm trọng. 24,0% công ty tầm trung phải đối mặt với spoofing CEO.
Khoản thanh toán doanh nghiệp: chuyển khoản vishing điều hành thành công trung bình 420.000 đô la mỗi lần (Kroll), vì 18,0% ngân hàng bán lẻ báo cáo các cuộc tấn công giọng nói tổng hợp trên mật khẩu IVR ngân hàng (ABA).
| Chỉ Số | Giá Trị | Nguồn |
|---|---|---|
| Cướp vishing giọng nói doanh nghiệp: các cuộc tấn công giả mạo nhân dạch giọng nói CEO/CFO nhắm vào bộ phận tài chính doanh nghiệp | 24,0% công ty tầm trung đã trải qua các nỗ lực lừa đảo giọng nói CEO | Báo Cáo Điều Tra Vi Phạm Dữ Liệu Verizon (DBIR) |
| Khoản thanh toán doanh nghiệp trung bình trong các cuộc lừa đảo ủy quyền chuyển khoản giọng nói AI doanh nghiệp thành công | 420.000 đô la tổn thất doanh nghiệp trung bình cho mỗi chuyển khoản vishing giọng nói thành công | Đánh Giá Rủi Ro Mạng Kroll |
| Spoofing dịch vụ khách hàng ngân hàng: tội phạm sử dụng bản sao giọng nói để vượt qua mật khẩu nhận dạng giọng nói ngân hàng điện thoại | 18,0% nỗ lực gian lận trung tâm cuộc gọi ngân hàng sử dụng giọng nói tổng hợp | Hiệp Hội Các Nhân Viên Ngân Hàng Hoa Kỳ (ABA) / Pindrop |
Thống kê gian lận trực tuyến và gian lận tài chính được kết nối với thống kê gian loan trực tuyến của chúng tôi. Nguồn: Báo Cáo Điều Tra Vi Phạm Dữ Liệu Verizon.
5. Kênh Thanh Toán và Phòng Chống: 62% Crypto/Chuyển Khoản và Từ Mã Aman
Tội phạm yêu cầu thanh khoản ngay lập tức thông qua các đường ray giải quyết không thể đảo ngược trước khi nạn nhân có thể liên hệ với thân nhân. 62,0% khoản thanh toán yêu cầu máy ATM Bitcoin hoặc chuyển khoản.
Phòng chống gia đình: 18,0% hộ gia đình đã thiết lập từ mã bằng lời nói khẩn cấp ‘an toàn’ (AARP), được hỗ trợ bởi 84,0% cuộc gọi di động được lọc qua các giao thức STIR/SHAKEN của nhà cung cấp.
| Chỉ Số | Giá Trị | Nguồn |
|---|---|---|
| Phương Thức Thanh Toán Yêu Cầu: máy ATM tiền điện tử, chuyển khoản ngân hàng, và ứng dụng ngang hàng (Zelle, Venmo) được yêu cầu bởi kẻ lừa đảo | 62,0% khoản thanh toán lừa đảo sao chép giọng nói được gửi qua máy ATM Bitcoin hoặc chuyển khoản tức thì | Telemetry Phương Thức Thanh Toán Mạng Giám Sát Người Tiêu Dùng FTC |
| Nhận thức từ mã an toàn: các gia đình thiết lập từ mã bằng lời nói ‘an toàn’ bí mật ngoại tuyến để xác thực các cuộc gọi khẩn cấp | 18,0% các gia đình đã thiết lập từ mã bằng lời nói khẩn cấp | Khảo Sát Mạng Giám Sát Gian Lận AARP |
| Chặn Cấp Nhà Cung Cấp: các nhà cung cấp viễn thông sử dụng các giao thức STIR/SHAKEN và phân tích cuộc gọi AI để lọc các cuộc gọi giọng nói tổng hợp robot | 84,0% các cuộc gọi giọng nói di động Hoa Kỳ được sàng lọc bằng các giao thức STIR/SHAKEN | Telemetry Ủy Ban Thông Tin Liên Bang (FCC) |
Xác thực passkey và mã thông báo phần cứng được kết nối với thống kê nhận thức passkey của chúng tôi. Nguồn: Mạng Giám Sát Gian Lận AARP.
6. Báo Cáo và Phục Hồi: 82% Không Báo Cáo và <2,5% Phục Hồi Pháp Luật
Chấn thương tâm lý nạn nhân và chuyển đổi tiền điện tử offshore tức thì làm cho khắc phục truyền thống gần như không thể. Ít hơn 2,5% quỹ bị đánh cắp được phục hồi.
Thiếu báo cáo: 82,0% nạn nhân không bao giờ báo cáo tổn thất do xấu hổ (FINRA), trong khi chỉ 22,0% công chúng biết rằng một clip mạng xã hội 3 giây là đủ để sao chép giọng nói của họ (McAfee).
| Chỉ Số | Giá Trị | Nguồn |
|---|---|---|
| Tỷ Lệ Báo Cáo Nạn Nhân: phần người tiêu dùng mất tiền trong các cuộc lừa đảo giọng nói không bao giờ báo cáo sự cố do xấu hổ hoặc nhầm lẫn | 82,0% sự cố lừa đảo sao chép giọng nói không bao giờ được báo cáo | Nghiên Cứu Quỹ Giáo Dục Nhà Đầu Tư FINRA |
| Tỷ Lệ Phục Hồi Thực Thi Pháp Luật: tỷ lệ phần trăm quỹ lừa đảo giọng nói bị đánh cắp được phục hồi và hoàn trả cho nạn nhân | <2,5% quỹ lừa đảo giọng nói bị đánh cắp được phục hồi thành công | Trung Tâm Phàn Nàn Tội Phạm Internet FBI (IC3) |
| Nhận Thức Người Tiêu Dùng: người dùng internet biết rằng 3 giây âm thanh mạng xã hội là đủ để sao chép giọng nói của họ | Chỉ 22,0% người tiêu dùng biết 3 giây âm thanh có thể sao chép giọng nói | Điều Tra Nhận Thức Công Chúng Starling Bank / McAfee |
Tóm Tắt: Lừa Đảo Giọng Nói AI Theo Các Con Số
| Chỉ Số | Giá Trị | Nguồn Chính |
|---|---|---|
| Tổn thất toàn cầu từ lừa đảo sao chép giọng nói AI | 4,20 tỷ đô la tổn thất | FTC / Starling Bank / McAfee |
| Người lớn bị nhắm mục tiêu bởi lừa đảo giọng nói AI | 28,5% người lớn toàn cầu | Nghiên Cứu Toàn Cầu McAfee |
| Sự gia tăng năm-so-với-năm trong các cuộc gọi lừa câu giọng nói AI | +185,0% tăng năm-so-với-năm | Báo Cáo Giọng Nói Pindrop |
| Phần lừa đảo khẩn cấp gia đình / thế chân ông bà | 48,0% lừa đảo giọng nói | Mạng Giám Sát Người Tiêu Dùng FTC / AARP |
| Tổn thất trung bình mỗi nạn nhân trong lừa đảo gia đình | 4.200 đô la / nạn nhân | Better Business Bureau (BBB) |
| Phần tổn thất do người cao tuổi (60+) chịu | 64,0% tổn thất toàn cầu | Báo Cáo Gian Lận Người Cao Tuổi FBI IC3 |
| Người tiêu dùng bị lừa bởi bản sao giọng nói AI 3 giây | 70,0% không thể phân biệt | Nghiên Cứu UCL / Starling Bank |
| Phần Instagram/TikTok của âm thanh được sưu tầm | 58,0% âm thanh được sưu tầm | Cảnh Báo CISA |
| Lừa đảo sử dụng âm thanh khó khăn nền | 92,0% sử dụng khó khăn khẩn cấp | Báo Cáo Nhân Viên FTC |
| Công ty tầm trung bị nhắm mục tiêu bởi lừa đảo giọng nói CEO | 24,0% công ty | Báo Cáo Verizon DBIR |
| Tổn thất công ty trung bình trong lừa đảo chuyển khoản giọng nói | 420.000 đô la / cướp công ty | Rủi Ro Mạng Kroll |
| Khoản thanh toán yêu cầu qua máy ATM Bitcoin / chuyển khoản | 62,0% khoản thanh toán lừa đảo | Telemetry Thanh Toán FTC |
| Gia đình nhận thức từ mã bằng lời nói bí mật | 18,0% gia đình | Mạng Giám Sát Gian Lận AARP |
| Tỷ lệ lừa đảo sao chép giọng nói không được báo cáo | 82,0% không bao giờ báo cáo | Quỹ Giáo Dục Nhà Đầu Tư FINRA |
| Quỹ lừa đảo giọng nói bị đánh cắp được cảnh sát phục hồi | <2,5% quỹ được phục hồi | Báo Cáo Hàng Năm FBI IC3 |
Phương Pháp Luận và Nguồn
Các thống kê trong báo cáo này được biên soạn từ telemetry khiếu nại từ Mạng Giám Sát Người Tiêu Dùng của Ủy Ban Thương Mại Liên Bang (FTC) và Trình Theo Dõi Gian Lận Better Business Bureau (BBB), các nghiên cứu nhận thức âm thanh từ Đại học University College London và Starling Bank, dữ liệu gian lận người cao tuổi từ Trung Tâm Phàn Nàn Tội Phạm Internet FBI (IC3) và AARP, pháp y vishing doanh nghiệp từ Verizon DBIR và Kroll, và các cảnh báo an ninh mạng từ CISA.
-
Ủy Ban Thương Mại Liên Bang (FTC) và AARP: Mạng Giám Sát Người Tiêu Dùng: Lừa Đảo Giả Mạo Nhân Dạch, Lừa Đảo Khẩn Cấp, và Phương Thức Thanh Toán (tổn thất 4,2 tỷ đô la, 48% lừa đảo gia đình, tổn thất trung bình 4.200 đô la).
-
Starling Bank và Đại học University College London (UCL): Nhận Thức Giọng Nói Tổng Hợp: Giới Hạn Phát Hiện Con Người và Rủi Ro Âm Thanh 3 Giây (70% bị lừa, 22% nhận thức).
-
McAfee và Pindrop Security: Khảo Sát Toàn Cầu ‘Beware the Artificial Imposter’ và Báo Cáo Tình Báo Giọng Nói (28,5% bị nhắm mục tiêu, +185% gia tăng vishing, 18% spoofing ngân hàng).
-
Trung Tâm Phàn Nàn Tội Phạm Internet FBI (IC3) và FINRA: Báo Cáo Gian Lận Người Cao Tuổi: Thống Kê Giả Mạo Nhân Dạch, Tỷ Lệ Phục Hồi, và Thiếu Báo Cáo (64% phần tổn thất người cao tuổi, <2,5% phục hồi, 82% không báo cáo).
-
Cơ Quan An Niền Mạng và Cơ Sở Hạ Tầng (CISA) và Verizon: Vishing Điều Hành, Sưu Tầm Âm Thanh Mạng Xã Hội, và Phân Tích DBIR (58% cạo TikTok/Insta, 24% cuộc tấn công CEO, tổn thất công ty 420.000 đô la).
-
Giám Sát Dữ Liệu: Các thống kê lừa đảo giọng nói AI phản ánh gian lận điện thoại, lừa câu giọng nói (vishing), và các cuộc tấn công kỹ thuật xã hội cụ thể sử dụng phần mềm sao chép giọng nói thần kinh sinh thành để giả mạo nhân dạch các cá nhân con người. Điều hành telemarketing tự động truyền thống mà không sao chép giọng nói được phân loại riêng biệt.
-
Lần cập nhật cuối cùng: Tháng Tám 2026. Bản tóm tắt này được cập nhật hàng quý khi các báo cáo Mạng Giám Sát Người Tiêu Dùng FTC, bản phát hành gian lận người cao tuổi FBI IC3, và các cuộc kiểm tra mối đe dọa viễn thông được công bố.