New York Times kontra OpenAI: proces, który określi przyszłość trenowania modeli
Pozew, który otworzył największą batalię prawną branży AI
W ostatnich dniach grudnia 2023 roku „New York Times” wniosł do federalnego sądu okręgowego na południu stanu Nowy Jork pozew przeciwko OpenAI oraz Microsoftowi, zarzucając firmom wykorzystanie milionów opublikowanych artykułów do trenowania modeli językowych, w tym ChatGPT, bez zgody i wynagrodzenia. Jak podała sama redakcja, wcześniejsze rozmowy o licencjonowaniu, prowadzone od wiosny tamtego roku, zakończyły się impasem. Sprawa oznaczona numerem 1:23-cv-11195 stała się pierwszym procesem tak dużego amerykańskiego medium przeciwko twórcom powszechnie używanych systemów generatywnej sztucznej inteligencji.
Stawka jest ogromna. Pozew domaga się „miliardów dolarów” odszkodowań ustawowych i rzeczywistych, a przy rażącym naruszeniu praw autorskich amerykańskie prawo przewiduje kary sięgające 150 tysięcy dolarów za pojedyncze utwór. Przy milionach artykułów chodzi więc o kwoty zdolne zachwiać finansami nawet największych graczy technologicznych.
O co toczy się spór o fair use
Rdzeniem sprawy jest amerykańska doktryna fair use, czyli dozwolonego użytku, który pozwala w określonych warunkach korzystać z chronionych utworów bez zgody autora. OpenAI i Microsoft utrzymują, że trening modeli na publicznie dostępnych tekstach ma charakter transformacyjny: maszyna uczy się wzorców języka, a nie kopiuje dzieł. Redakcja odpowiada, że nie ma nic transformacyjnego w wykorzystywaniu jej materiałów bez zapłaty do budowy produktów konkurujących z samą gazetą i odbierających jej czytelników.
W uzasadnieniu pozwu znalazło się sto przykładów sytuacji, w których ChatGPT odtwarzał fragmenty artykułów niemal dosłownie — załącznik ten przez długi czas stanowił główny dowód redakcji. OpenAI ripostowała, że część takich rezultatów wymuszały specjalnie skonstruowane prompty, a powtarzanie całych tekstów traktuje jako rzadką wadę, nad którą pracuje. Do tego doszedł zarazem delikatny wątek reputacyjny: model potrafił przypisywać gazecie artykuły, których nigdy nie napisała.
Od wniesienia pozwu do etapu dowodowego
Przez pierwsze dwa lata proces toczył się falami. OpenAI próbowała umorzyć sprawę już na początku 2024 roku, argumentując między innymi, że roszczenia są przedawnione. W kwietniu 2025 roku sędzia Sidney H. Stein oddalił ten wniosek w kluczowym zakresie: zarzuty bezpośredniego i współuczestniczącego naruszenia praw autorskich mogły zostać rozpoznane merytorycznie. Sąd zaznaczył jednocześnie, że kwestia fair use to zagadnienie faktyczne, które dopiero czeka na rozstrzygnięcie, i nie przesądził jej na tym etapie.
Następnie sprawa wkroczyła w fazę gromadzenia dowodów, burzliwą jak na standardy procesów cywilnych. Sędzia referendarz Ona Wang nakazała OpenAI udostępnienie próby dwudziestu milionów anonimizowanych rozmów użytkowników z ChatGPT — także tych niezwiązanych z artykułami gazety — uznając je za istotne dla obrony fair use. Sędzia Stein potwierdził ten nakazar w styczniu 2026 roku, mimo protestów firmy, która wskazywała na prywatność dziesiątków milionów ludzi. Równocześnie centrum ciężkości sporu przesunęło się z tego, co chatbot potrafi wygenerować, na legalność samego treningu.
Według śledzących proces serwisów prawnych streszczenie stanowisk stron miało zostać złożone wiosną 2026 roku, a rozprawa jest możliwa pod koniec 2026 lub w 2027 roku. Do tego czasu żadnemu sądowi w USA nie udało się jeszcze rozstrzygnąć, czy trening modeli na materiałach prasowych mieści się w ramach dozwolonego użytku.
Szersze pole bitwy i sygnały z innych sal sądowych
Sprawa gazety nie jest odosobniona. Setki pozwów pisarzy, wydawców i artystów przeciwko firmom AI połączyło się w postępowanie zbiorcze przed tym samym sądem na Manhattanie. Część drobniejszych spraw prasowych zakończyła się wcześniej fiaskiem powodów: pozwy serwisów Raw Story i AlterNet zostały oddalone, głównie dlatego że skupiały się na usuwaniu informacji o autorstwie, a nie na samym kopiowaniu tekstów. Tym mocniej wybija się staranniejszy zarzut redakcji „Timesa”.
Orientacyjne punkty odniesienia przyniosły też kalifornijskie sądy. Latem 2025 roku sędziowie w sprawach Bartz v. Anthropic oraz Kadrey v. Meta uznaali, że sam trening na nabytych książkach może być dozwolonym użytkiem — choć w pierwszej ze spraw Anthropic zgodził się zapłacić autorom rekordowe 1,5 miliarda dolarów za wykorzystanie pirackich egzemplarzy. Orzeczenia te pokazują, że granica przebiega gdzieś między sposobem pozyskiwania danych a skutkami rynkowymi, i właśnie tę granicę ma precyzyjnie wyznaczyć proces z Manhattanu.
Co to oznacza dla mediów i czytelników
Dla redakcji wynik procesu zadecyduje, czy będą mogły żądać licencyjnych opłat za wykorzystanie archiwów, czy też pozostaną im negocjacje z pozycji słabszej. Dla czytelników stawka jest równie realna: jeśli modele zastąpią dziennikarstwo jako źródło informacji, ale będą czerpać z jego dorobku bez pokrycia kosztów, jakość i wiarygodność informacji może się systematycznie obniżać. Wydawcy uczą się już ostrożności — coraz więcej serwisów blokuje robotom zbierającym dane dostęp do swoich stron, a umowy licencyjne zawierane bezpośrednio z firmami AI stają się alternatywą dla sądowych zmagań.
Konkluzja jest jednoznaczna: niezależnie od tego, którą stronę wskaże sąd, proces „New York Times” kontra OpenAI wyznaczy reguły gry dla całej gospodarki treningowej sztucznej inteligencji. To, co rozstrzygnie jedna sala sądowa na Manhattanie, zdecyduje o tym, kto i za ile będzie mógł uczyć maszyny mówić ludzkim głosem.