Halucynacje ChatGPT w sądzie: sprawa Mata v. Avianca i 1300 kolejnych przypadków

Halucynacje ChatGPT w sądzie: sprawa Mata v. Avianca i 1300 kolejnych przypadków

Mata v. Avianca: jak ChatGPT oszukał adwokata

W maju 2023 roku adwokat Stephen Schwartz złożył w Sądzie Federalnym Południowego Dystryktu Nowego Jorku pismo procesowe w sprawie Mata v. Avianca — pozwu o obrażenia ciała przeciwko linii lotniczej Avianca. Zamiast oprzeć się na prawdziwych orzeczeniach, Schwartz poprosił ChatGPT o podanie precedensów. Model wymienił sześć spraw, z których żadna nie istniała — miała brzmieć przekonująco, ale była całkowicie zmyślona.

Schwartz twierdził później, że nigdy wcześniej nie korzystał z ChatGPT i nie wiedział, że model potrafi wymyślać orzeczenia. Co gorsza — nawet gdy zorientował się, że precedensy mogą być fałszywe, ChatGPT upewniał go, że są autentyczne. Model z przy pewnością siebie powtórzył błędne informacje, zamiast przyznać się do nieznajomości spraw.

Sędzia nakłada karę

W odpowiedzi na ten incydent sędzia Brantley Starr z Federalnego Sądu Okręgu Północnego Teksasu zakazał składania pism procesowych generowanych przez AI bez wcześniejszej weryfikacji przez człowieka. W swoim uzasadnieniu napisał, że systemy generatywnej sztucznej inteligencji w obecnym stanie są podatne na halucynacje i uprzedzenia. Stwierdził, że wymyślają treści — w tym cytaty i przypisy — a ponieważ nie składają przysięgi adwokackiej, nie są zobowiązane do lojalności wobec klienta, prawa ani Konstytucji Stanów Zjednoczonych. Działają według kodu, nie przekonania — według programowania, nie zasad.

W czerwcu 2023 roku sędzia P. Kevin Castel umorzył sprawę Mata i nałożył na Schwartza oraz drugiego adwokata grzywnę 5000 dolarów za niesumienną postawę. Obaj nadal powoływali się na fikcyjne precedensy, mimo że wcześniejzapewniali o ich prawdziwości. Castel zwrócił uwagę na liczne błędy i niespójności w wygenerowanych opiniach — jedną z nich określi jako bełkot i tekst graniczący z nonsensem. Kluczowy szczegół: model nie wymyślił tylko nieistniejących nazw spraw — wygenerował fragmenty, które brzmiały uderzająco podobnie do prawdziwych orzeczeń. Wystarczająco podobnie, by oszukać i klienta, i adwokata.

Baza 1300 przypadków

Skala problemu rośnie. W kwietniu 2025 roku Damien Charlotin — wykładowca HEC Paris i Sciences Po — utworzył bazę AI Hallucination Cases, która dokumentuje przypadki halucynacji w decyzjach prawnych. Rok później baza odnotowała ponad 1300 incydentów. To ponad 100 nowych przypadków miesięcznie. Nie jest to anomalia — jest to systematyczny problem wymiaru sprawiedliwości, w którym adwokaci i sędziowie coraz częściej ufają wygenerowanym tekstom, a weryfikacja źródeł bywa zaniedbywana.

W odpowiedzi amerykańscy sędziowie na całym kraju sankcjonują adwokatów za składanie wierutnych fałszów z generowanych pism. Badacze zaczynają traktować halucynacje modeli językowych w kontekście prawnym jako odrębną kategorię ryzyka. Model, który produkuje wiarygodnie brzmiące, ale całkowicie fałszywe orzeczenia, uderza w fundamenty prawa precedensowego — w którym orzeczenie jest najważniejszym materiałem prawnym.

Gjøvik v. Apple: pro se plaintiff

Wikipedia przytacza jeszcze jedną sprawę. W maju 2025 roku Ashley Gjøvik — powódka reprezentująca sama siebie, z dyplomem prawniczym Santa Clara University — została upomniana przez sędziego Edwarda Chena w Federalnym Sądzie Okręgu Północnej Kalifornii za umieszczenie w pozwie przeciwko Apple wielu halucynacji AI. Sędzia ostrzegł, że kolejne incydenty skończą się oskarżeniem o obrazę sądu i odebraniem jej prawa do samodzielnej reprezentacji.

Sprawa jest fundamentalna dla interpretacji zasady 11 Federalnych Zasad Postępowania Cywilnego dotyczącej profesjonalnego postępowania — była wielokrotnie przywoływana przez innych sędziów jako obowiązujący standard. Została też omówiona przez American Bar Association w ramach aktualizacji zasad etyki zawodowej. To znaczące: sprawa indywidualnej powódki z akademickim wykształceniem prawnym faktycznie kształtuje wzorzec postępowania adwokatów w erze AI.

Dlaczego model kłamie

ChatGPT — udostępniony 30 listopada 2022 roku, osiągnął 100 milionów użytkowników miesięcznie w ciągu dwóch miesięcy i 900 milionów tygodniowo aktywnych użytkowników w lutym 2026 — był krytykowany za ograniczenia i potencjał nieetycznego użycia. Może generować wiarygodnie brzmiące, ale błędne lub nonsensowne odpowiedzi. Up rzedzenia w danych treningowych znajdują odbicie w jego odpowiedziach.

Z perspektywy architektury modelu weryfikacja wywiedzenia z danych treningowych nie jest jego cechą. Model językowy nie sprawdza, czy wygenerowane orzeczenie naprawdę istnieje — produkuje jedynie tokeny, które są najbardziej prawdopodobne w danym kontekście. Kiedy kontekstem jest pismo prawne, model często generuje nazwy i opisy precedensów, które wyglądają jak prawdziwe, ale są fikcyjne. To nie jest błąd — to fundamentalna cecha architektury transformerowej. Twórca modelu może ograniczyć częstotliwość halucynacji przez RLHF, RAG lub testy, ale nie może ich całkowicie wyeliminować z modelu, który nie rozumuje — tylko generuje tekst.

Konsekwencje dla zawodu prawniczego

Reakcja środowiska prawniczego jest postępująca. Amerykańska izba adwokacka rozważa aktualizację zasad etyki zawodowej. Sędziowie federalni i stanowi wydają zarządzenia zakazujące używania wygenerowanych pism bez weryfikacji przez człowieka. Baza AI Hallucination Cases staje się poważnym narzędziem samoregulacji zawodu.

Z punktu widzenia klienta sytuacja jest niepokojąca: nawet jeśli adwokat nie mówi, że korzysta z ChatGPT, ryzyko, że jego pismo zawiera fikcyjne precedensy, jest dziś realne. W jurysdykcjach, gdzie adwokat odpowiada za dokładność dokumentów składanych do sądu, używanie materiału z AI bez weryfikacji jest już czysto karne. Sprawa Mata v. Avianca z 2023 roku była pierwszą — baza AI Hallucination Cases odnotuje kolejne. To nie jest przypadek jednostkowy; to systematyczne zjawisko, które właśnie zostało zmapowane.

Więcej w tym temacie

Czytaj dalej

Air Canada i chatbot, który zmyślił politykę biletową: kiedy firma odpowiada za to, co wymyśli sztuczna inteligencja

Air Canada i chatbot, który zmyślił politykę biletową: kiedy firma odpowiada za to, co wymyśli sztuczna inteligencja

Apple Intelligence i zmyślone streszczenia: jak powiadomienia fałszywie poinformowały o samobójstwie podejrzanego i coming oucie tenisisty

Apple Intelligence i zmyślone streszczenia: jak powiadomienia fałszywie poinformowały o samobójstwie podejrzanego i coming oucie tenisisty

Halucynacje AI w medycynie: kiedy algorytm zmyśla diagnozę

Halucynacje AI w medycynie: kiedy algorytm zmyśla diagnozę

Halucynacje AI: dlaczego sztuczna inteligencja pewnie siebie zmyśla fakty

Halucynacje AI: dlaczego sztuczna inteligencja pewnie siebie zmyśla fakty