Shadow AI: gdy firmowe dane trafiają do publicznych chatbotów
Ukryta komunikacja, którą każdy zna z praktyki
Wiele organizacji wdrożyło już własne, zarządzane środowiska pracy z modelem językowym: osobną instancję z umową o przetwarzaniu danych, dziennikiem zdarzeń i wyłączonym trenowaniem na przesyłanych treściach. Równolegle pracownicy otwierają w przeglądarce darmowy czat i wklejają do niego fragmenty prawdziwej pracy — kod, umowę, notatki ze spotkania z klientem, opis awarii. Robią to po godzinach, na prywatnym laptopie, z domowego łącza. Ten obszar wykorzystywania sztucznej inteligencji, niewidoczny dla działów bezpieczeństwa, opisuje się terminem shadow AI: analogicznie do shadow IT, czyli niezarządzanego oprogramowania w firmach.
Mechanika wycieku jest rutynowa. Treść wklejona do publicznego chatbota opuszcza infrastrukturę pracodawcy i trafia do systemów zewnętrznego dostawcy. Jeżeli warunki korzystania z usługi przewidują wykorzystanie rozmów do trenowania modeli — a darmowe warianty narzędzi często tak czynią — fragmenty tajemnicy przedsiębiorstwa mogą stać się częścią modelu, który następnego dnia odpowiada na pytania zupełnie obcych osób. Nie trzeba nawet wyobrażać sobie złośliwości wystarczającej do wykradzenia danych: wystarczy zwykłe lenistwo i pośpiech.
Dlaczego ludzie to robią
Pisanie opisu zjawiska bez jego przyczyn niczego nie uczy. Badania nad zachowaniami pracowników opisują rutynowy schemat: pracownik ma zadanie z terminem, oficjalne narzędzie wymaga zgody przełożonego, licencji albo logowania przez firmowe konto — darmowy czat działa natychmiast. Presja terminów wygrywa z procedurą. Do tego dochodzi przekonanie, że wklejany fragment jest „mały i nieistotny”: jedna funkcja programu, akapit umowy, lista nazwisk. Z perspektywy pojedynczego człowieka ryzyko wygląda na znikome; z perspektywy całej organizacji, w której setki osób powtarza ten sam nawyk, skala przecieku robi się realna.
Gdy wyciek staje się precedensem
Najgłośniejszy przykład dotyczy Samsunga. W 2023 roku koreańskie media doniosły o kilku przypadkach, w których inżynierowie firmy wkleili poufny kod źródłowy do publicznego chatbota, a wkrótce potem Samsung ograniczył korzystanie z narzędzi generatywnej sztucznej inteligencji na urządzeniach i sieci firmowej. Sprawa stała się podręcznikowym precedensem: nie wymagała ataku hakerskiego, wystarczył zwykły kopiuj-wklej.
Regulatorzy prywatności zareagowali na podobne ryzyko wcześniej. Włoski urząd ochrony danych osobowych (Garante) w marcu 2023 roku czasowo wstrzymał przetwarzanie danych użytkowników z włoskich adresów przez ChatGPT, zarzucając naruszenia unijnego rozporządzenia o ochronie danych; usługa wróciła po wprowadzeniu zabezpieczeń. W listopadzie 2024 roku Garante nałożył na OpenAI karę pieniężną w wysokości 15 milionów euro — w marcu 2026 roku sąd w Rzymie uchylił jednak całą decyzję z powodu kwestii właściwości organu, nie rozstrzygając, czy doszło do naruszenia. Wniosek dla firm w Europie jest prosty: odpowiedzialność za przetwarzanie danych osobowych w narzędziach AI nie znika dlatego, że czat jest darmowy i „ktoś inny” nim zarządza.
Co naprawdę ogranicza ryzyko
Zakazy wydają się naturalną reakcją, ale w praktyce przesuwają użycie modeli głębiej w cień: pracownik nie przestaje korzystać, przestaje przyznawać. Skuteczniejsze podejście łączy trzy elementy. Pierwsze: dostęp do zarządzanych narzędzi z umowami o przetwarzaniu danych i wyłączonym trenowaniem — tak, by legalna droga była wygodniejsza niż obejście. Drugie: jasne zasady, jakie kategorie treści nigdy nie mogą trafić do żadnego czatu: tajemnica przedsiębiorstwa, dane osobowe, materiały objęte umowami o poufności. Trzecie: szkolenie oparte na przykładach z własnej branży, a nie na ogólnikach — pracownik zapamiętuje historię wycieku kodu, nie slajd o „bezpieczeństwie danych”.
Publiczne chatboty nie znikną z miejsc pracy. Pytanie nie brzmi, czy pracownicy będą korzystać z modeli, lecz czy zrobią to w środowisku, które firma zna i umie kontrolować — czy głębiej w cieniu.
Oznaczenie treści AI
Ten artykuł powstał z udziałem sztucznej inteligencji: research oraz tekst przygotował i zredagował agent AI. Dane, daty i cytaty przytoczone w tekście pochodzą ze zweryfikowanych źródeł.