Głos sklonowany — oszustwo przez klonowanie głosu i wideo w 2025 r.
W kwietniu 2026 r. FBI opublikowało raport roczny Internet Crime Complaint Center (IC3) za 2025 r. Po raz pierwszy w 25-letniej historii centrum utworzono odrębną kategorię przestępczości związanej z AI. Wynik: 22 364 skargi i 893 mln USD udokumentowanych strat — liczby, które FBI samo określa jako konserwatywny dolny pułap, ponieważ większość ofiar nie składa zawiadomień[^1^].
Oszustwo przez AI nie jest już teoretyczne. Klonowanie głosu wymaga dziś około trzech sekund czystego nagrania — wystarczy wiadomość głosowa, filmik z TikToka czy krótkie pozdrowienie. Badanie McAfee z 2024 r. wykazało, że 77% osób, które rozmawiały z przekonującym klonem głosu i zaangażowały się w rozmowę, straciło pieniądze[^2^]. To oznacza, że technologia sama w sobie jest tylko narzędziem — kluczowe jest to, jak skutecznie usuwa barierę psychologiczną: gdy słyszysz głos bliskiej osoby w kryzysie, racjonalna obrona często wyłącza się w ciągu sekund.
Oszustwo głosem — od wypowiedzi do przelewu
Najbardziej destrukcyjny mechanizm działa w dwóch etapach. Po pierwsze, przestępca pozyskuje próbkę głosu — z publicznego filmu, wiadomości głosowej czy nawet krótkiego nagrania rozmowy. Po drugie, generuje klon w czasie rzeczywistym i dzwoni pod numer spoofowany, by wyglądał jak połączenie od rodziny lub przełożonego. FBI odnotowało ponad 5 mln USD strat w tzw. oszustwach „w niebezpieczeństwie” (distress scams), w których klonowany głos rodzica, dziecka czy partnera symuluje kryzys — wypadek, areszt, utratę ciąży — i żąda natychmiastowego przelewu[^1^].
Drugi wymiar to oszustwo przez e-mail (BEC) z warstwą audio. Przestępca wysyła przekonujące pismo procesowe lub wiadomość od „dyrektora finansowego” z instrukcją przelewu, a następnie dzwoni z klonowanym głosem tego samego dyrektora, potwierdzając prośbę. FBI udokumentowało ponad 30 mln USD strat związanych wyłącznie z BEC, w których potwierdzono udział AI — liczba, która w rzeczywistości jest znacznie wyższa, bo większość ataków nie zostawia oczywistych śladów technicznych[^1^].
Najpoważniejszy pojedynczy incydent pozostaje sprawa brytyjskiej firmy inżynieryjnej Arup: w 2024 r. pracownik z Hongkongu uczestniczył w wideokonferencji z rzekomym dyrektorem finansowym i kilkoma „współpracownikami” — wszyscy byli generowani przez AI. Przelew: 25 mln USD. Incydent ten wykazał, że deepfake w czasie rzeczywistym na wideokonferencjach jest już operacyjnie możliwy, a nie tylko teoretyczny[^2^].
Dlaczego statystyki są zaniżone
FBI wyraźnie zaznacza trzy przyczyny zaniżenia. Po pierwsze — niedoszacowanie zgłoszeń: szacuje się, że mniej niż 20% ofiar cyberprzestępczości składa zawiadomienie. Po drugie — trudność atrybucji: doskonały klon głosu nie zostawia oczywistego śladu kryminalistycznego, więc atak jest klasyfikowany po prostu jako oszustwo inwestycyjne czy BEC, bez wskazania AI. Po trzecie — częściowe zaangażowanie AI: jeśli oszust użył AI do wygenerowania pierwszej wiadomości, ale resztę przeprowadził przez zwykły telefon, trudno jednoznacznie zaklasyfikować zdarzenie[^3^].
Dodatkowo raport IC3 wskazuje, że osoby powyżej 60. roku życia poniosły straty w wysokości 7,748 mld USD z powodu oszustw technologicznych i wsparcia technicznego — wzrost o 59% względem 2024 r. Część z tych strat wynika z klonowania głosu i fałszywych połączeń z „urzędów” czy „banków”[^1^].
Co to oznacza w praktyce
Dla przedsiębiorstw oznacza to konieczność zmiany procedur weryfikacji: rozmowa telefoniczna przestała być wystarczającym potwierdzeniem tożsamości. FBI zaleca wielokanałową weryfikację dla każdego przelewu — np. oddzwonienie na znany numer z katalogu wewnętrznego, a nie ten z wiadomości. Dla rodzin — wprowadzenie kodów weryfikacyjnych i zasady: każda prośba o pieniądze w kryzysie musi być potwierdzona drugim kanałem.
Technologia klonowania głosu i wideo nie jest już przyszłością — jest obecnym zagrożeniem. A dane FBI za 2025 r. pokazują, że jego skalę dopiero zaczynamy rozumieć.