Głos sklonowany, konto wyczyszczone — jak AI napędza oszustwa finansowe
W styczniu 2024 roku pracownik firmy inżynieryjnej Arup w Hongkongu dołączył do pozornie rutynowej wideokonferencji z dyrektorem finansowym i kilkoma kolegami. Każdy uczestnik na ekranie był generowany przez sztuczną inteligencję. Pracownik wykonał piętnaście przelewów na łączną kwotę 200 milionów dolarów hongkońskich — około 25 milionów dolarów amerykańskich — zanim oszustwo wyszło na jaw. Sprawa stała się symbolem nowej ery przestępczości cyfrowej.
Od głosu do przelewu — cztery etapy oszustwa
Atak oparty na klonowaniu głosu (tzw. deepfake vishing) składa się z czterech etapów. Najpierw przestępcy zbierają materiał źródłowy — podcasty, nagrania z konferencji, filmiki w mediach społecznościowych, a nawet wiadomości głosowe z poczty głosowej. Wystarczy kilka sekund czystego nagrania, by nowoczesne modele syntezy mowy (Google Tacotron 2, Microsoft VALL-E, komercyjne platformy typu ElevenLabs) wygenerowały realistyczną kopię głosu.
Następnie syntetyczny głos jest łączony z precyzyjnym naciskiem psychologicznym — pilnymi terminami płatności, groźbami prawnymi lub scenariuszami kryzysów rodzinnych. Ofiara słyszy głos, który zna i którym ufa, więc mechanizmy obronne zawodzą. Według raportu FBI IC3 z 2024 roku przestępstwa typu BEC (business email compromise) i pokrewne oszustwa wygenerowały straty w wysokości 2,77 miliarda dolarów w samych Stanach Zjednoczonych.
Trzeci etap to transfer środków — zwykle przez łańcuchy kont bankowych lub miksery kryptowalutowe. Grupa analityczna Group-IB szacuje, że mniej niż pięć procent skradzionych środków udaje się odzyskać.
Skala problemu — liczby bez fikcji
W regionie Azji i Pacyfiku liczba prób oszustw z wykorzystaniem sztucznej inteligencji wzrosła o 194 procent w 2024 roku w porównaniu z rokiem poprzednim. Globalne straty z powodu oszustw AI szacuje się na 12 miliardów dolarów w 2023 roku, a prognozy Deloitte i branży cyberbezpieczeństwa wskazują na możliwy wzrost do 40 miliardów dolarów do 2027 roku.
W październiku 2025 roku OECD.AI dokumentował incydent we Włoszech, gdzie przestępcy wykorzystali sklonowany głos ministra obrony Guido Crosetto, by wyłudzić pieniądze od przedsiębiorców. Sprawa trafiła na policję, a szkody są potwierdzone.
Luka prawna
W Stanach Zjednoczonych brak jest federalnej ustawy, która wprost kryminalizowałaby klonowanie głosu jako narzędzie oszustwa finansowego. FCC orzekła w lutym 2024 roku, że głosy generowane przez sztuczną inteligencję w robocallach naruszają ustawę o ochronie konsumentów przed niechcianymi połączeniami — to jednak wąska podstawa. Ustawodawstwo stanowe i europejskie (EU AI Act) zaczyna wypełniać tę lukę, ale tempo zmian legislacyjnych pozostaje wolniejsze niż tempo technologii.
Co można zrobić?
Eksperci ds. cyberbezpieczeństwa zalecają weryfikację wielokanałową: każde żądanie przelewu, nawet z głosem prezesa, musi być potwierdzone przez drugi, wcześniej ustalony kanał komunikacji — najlepiej rozmowę twarzą w twarz lub wiadomość w szyfrowanym komunikatorze. Organizacje powinny wprowadzać hasła weryfikacyjne (pre-agreed verbal code words) oraz wymagać co najmniej dwóch osób przy autoryzacji przelewów powyżej określonego progu.
Oszustwa z użyciem sztucznej inteligencji nie są już futurystyczną wizją — to rzeczywistość, która wymaga od firm i osób prywatnych nowej dyscypliny weryfikacji. Gdy głos przestaje być dowodem tożsamości, zaufanie musi być budowane inaczej niż przez rozpoznanie dźwięku.
Źródła: The Guardian / OCCRP / SVT (marzec 2025), OECD.AI (październik 2025), Group-IB, Adaptive Security, FBI IC3 2024 Annual Report.