OpenAI Sora: text-to-video bez pozwolenia, watermark złamany w tydzień i wyłączenie marki 26 kwietnia 2026
OpenAI Sora: sztuczna inteligencja generująca wideo z tekstu
OpenAI Sora była modelem text-to-video oraz społecznościową aplikacją opracowaną przez laboratorium badawcze OpenAI. Kodowana pod nazwą zaczerpniętą z japońskiego słowa oznaczającego „niebo”, Sora generowała krótkie klipy wideo na podstawie podpowiedzi tekstowych — promptów — i potrafiła również przedłużać istniejące, krótkie materiały wideo. W odróżnieniu od modeli operujących na obrazach statycznych, Sora poruszała się w wymiarze czasu: syntetyzowała ruch, zmianę oświetlenia oraz spójność postaci między klatkami. Była jednym z najbardziej dyskutowanych i kontrowersyjnych systemów generatywnej sztucznej inteligencji dekady — pod względem prawa autorskiego i wiarygodności mechanizmów transparentności.
Technologia text-to-video polega na przekształcaniu opisu tekstowego w sekwencję wizualną. Użytkownik opisuje scenę — na przykład „kobieta spacerująca po deszczowym mieście z czerwonym parasolem” — a model generuje kilkusekundowy lub dłuższy klip stanowiący realizację tego opisu. Wymaga to symultanicznego modelowania geometrii obiektów, dynamiki ruchu oraz sekwencji czasowej. Wyzwanie jest większe niż w generowaniu pojedynczych obrazów, ponieważ każdy klip musi utrzymywać zgodność między klatkami — postać nie może zmienić twarzy ani proporcji z jednej sekundy na drugą.
Sora nie była pierwszym modelem tej klasy. Przed jej premierą kilka modeli generowania wideo z tekstu powstało u innych twórców, a ich istnienie ukształtowało oczekiwania rynkowe, z którymi OpenAI musiało się zmierzyć. Sora wyróżniała się długością generowanych materiałów i jakością, która wzbudziła dyskusję o przybliżaniu się do materiału trudnego do odróżnienia od autentycznego nagrania.
Chronologia: od demonstracji w lutym 2024 do Sora 2
Publiczna historia Sory rozpoczęła się w lutym 2024 roku, kiedy OpenAI zaprezentowało publicznie pierwsze przykłady outputu modelu. Próbki — krótkie, niemal fotorealistyczne klipy — sugerowały skok jakościowy w stosunku do dotychczasowych osiągnięć w generowaniu wideo z tekstu. W tamtym okresie model nie był powszechnie dostępny; OpenAI ograniczało się do publikacji wybranych materiałów demonstracyjnych i technicznych notek opisujących architekturę.
Dopiero w grudniu 2024 roku OpenAI wydało pierwszy release Sory, publicznie dostępny dla użytkowników subskrypcji ChatGPT Plus oraz ChatGPT Pro w Stanach Zjednoczonych i Kanadzie. Wymóg płatnej subskrypcji i ograniczenie geograficzne interpretowano jako element ostrożnego wdrażania modelu o dużym potencjale nadużyć — w szczególności w kontekście deepfake’ów i dezinformacji. Ograniczenie do USA i Kanady pozostawało w mocy przez kolejne miesiące, co wskazywało na obawy regulacyjne związane z rynkami europejskimi.
Koniec września 2025 roku przyniósł drugą generację modelu — Sora 2 — wydaną dla wybranych użytkowników w USA i Kanadzie. Nowa wersja była zintegrowana z funkcjami społecznościowymi w aplikacji, co stanowiło istotne posunięcie strategiczne: Sora przestała być wyłącznie narzędziem generatywnym, a stała się platformą, na której użytkownicy mogli dzielić się wygenerowanymi klipami. Warstwa społecznościowa zmieniała spektrum ryzyka — prywatne narzędzie stało się publicznym kanałem dystrybucji treści generowanej AI.
Prawa autorskie: trening bez domyślnego opt-out
Jednym z najbardziej kontrowersyjnych elementów Sory jest podejście do materiałów chronionych prawem autorskim. Generator domyślnie korzysta z materiałów chronionych prawem autorskim, chyba że posiadacze praw aktywnie zrezygnują — tzw. mechanizm opt-out. Konstrukcja ta odwraca tradycyjną logikę licencjonowania: domyślnym stanem nie jest zgoda, lecz wykorzystanie, a ciężar przeciwdziałania przeniesiono na posiadaczy praw autorskich, którzy muszą sami zidentyfikować swoje utwory w zbiorach treningowych i wystąpić o ich wyłączenie.
Podejście to jest sporne z kilku powodów. Po pierwsze, wymaga od twórców świadomości, które utwory zostały wykorzystane — informacji często nieudostępnianej w pełni. Po drugie, opt-out najczęściej przyjmuje formę jednorazowego zgłoszenia, które nie gwarantuje, że model już „nauczył się” wzorców zawartych w danym utworze; wycofanie wagi z modelu fundamentalnego jest w praktyce niemożliwe. Po trzecie, dla niezależnych twórców — filmowców czy ilustratorów niezrzeszonych z dużymi organizacjami branżowymi — mechanizm ten jest proporcjonalnie trudniejszy do zrealizowania.
Problem wpisuje się w debatę o prawie autorskim w erze generatywnej sztucznej inteligencji. W odróżnieniu od modeli text-to-image, takich jak Stable Diffusion, wokół których toczyły się głośne spory sądowe (m.in. sprawa Getty Images przeciwko Stability AI), dyskurs prawny dotyczący modeli text-to-video był wciąż formułowany. Sora pojawiła się, gdy sądy dopiero zaczynały rozstrzygać, czy wagi modelu stanowią „kopię” utworu chronionego, czy abstrakcyjną reprezentację wzorców statystycznych. Brak domyślnego opt-out ułatwiał wykorzystanie materiałów na wczesnym etapie rozwoju, ale generował ryzyko pozwów i presję regulacyjną.
Watermark złamany w tydzień
OpenAI wbudowało w klipy generowane przez Sorę cyfrowy, przesuwalny watermark — znak wodny, który miał umożliwić identyfikację materiału jako wygenerowanego przez sztuczną inteligencję. Znak był przesuwalny, co oznaczało, że nie zajmował stałego miejsca w kadrze, lecz zmieniał pozycję — utrudniając proste kadrowanie lub maskowanie. Mechanizm miał służyć transparentności: widzowie mieli móc rozpoznać, że obraz pochodzi z generatora, a nie z kamery.
Skuteczność tej metody okazała się ograniczona. Już w tydzień po debiucie Sora 2 pod koniec września 2025 roku dostępne stały się programy firm trzecich, które usuwały watermark z klipów. Tempo obejścia mechanizmu transparentności stanowiło istotny sygnał dla regulatorów — wskazywało, że dobrowolne, techniczne środki oznaczania treści AI-generowanej są z natury podatne na obchodzenie, zwłaszcza gdy treść ma wartość rynkową lub propagandową.
Problem watermarku ma wymiar szerszy niż pojedynczy produkt. Debata o transparentności AI-generowanych treści opiera się na dwóch filarach: oznaczaniu materiału na etapie produkcji (znak wodny, metadane C2PA) i wykrywaniu materiału na etapie dystrybucji (systemy klasyfikacji w mediach społecznościowych). Sora dostarczyła przypadku testowego obu filarów: watermark złamano w tydzień, a warstwa społecznościowa aplikacji stworzyła kanał dystrybucji, w którym identyfikacja pochodzenia materiału była potencjalnie trudna. Dla deepfake’ów politycznych czy dezinformacji w okresach wyborczych tempo obchodzenia watermarku budzi konkretne obawy — przeciwdziałanie nie może opierać się wyłącznie na technicznych oznaczeniach, które można usunąć prostym narzędziem.
Zamknięcie aplikacji i wyłączenie API
26 kwietnia 2026 roku aplikacja Sora została zamknięta. Zgodnie z zapowiedzią OpenAI, interfejs programistyczny API modelu zostanie wyłączony do 24 września 2026 roku, co kończy markę Sora AI jako całość. Decyzja wpisuje się w trend reorganizacji oferty generatywnej sztucznej inteligencji, ale jej wymiar symboliczny jest istotny: model prezentowany nieco ponad rok wcześniej jako symbol technologicznego przodownictwa został wycofany w ciągu szesnastu miesięcy.
Między zamknięciem aplikacji a wyłączeniem API pozostaje okno około pięciu miesięcy, w którym istniejące integracje mogą zostać zarchiwizowane. Okres przejściowy jest znaczący z perspektywy prawnej: klientom biznesowym korzystającym z API należy dać czas na migrację, ale utrzymywanie dostępu do modelu w tym oknie potencjalnie utrzymuje w mocy zarzuty związane z materiałami chronionymi prawem autorskim, które posłużyły do treningu. Wyłączenie marki nie rozwiązuje fundamentalnych pytań prawnych — pozwy mogą być kontynuowane, a orzeczenia dotyczące modelu mogą wpływać na kolejne generacje technologii text-to-video.
Wnioski: kontrola AI-generowanego wideo po Sorze
Przypadek Sora dostarcza kilku wniosków dla debaty o kontroli AI-generowanego wideo. Po pierwsze, dobrowolne techniczne środki transparentności — nawet utrudniające obchodzenie — są z natury wystawione na działania firm trzecich. Skoro przesuwalny cyfrowy watermark usunięto w tydzień po debiucie ulepszonej wersji, systemy oznaczania treści muszą być wspierane standardami metadanych chronionymi kryptograficznie i odpowiedzialnością platform dystrybuujących materiały.
Po drugie, brak domyślnego opt-out stworzył asymetrię, w której ciężar ochrony przeniósł się na twórców. Sora korzystała z materiałów filmowych, animacyjnych i fotograficznych o niejednoznacznym statusie prawnym. Praktyka ta implikuje przejście od logiki opt-out do logiki opt-in — wyraźnej, uprzedniej zgody — przynajmniej w jurysdykcjach, które traktują trening na materiałach chronionych jako kopiowanie.
Po trzecie, zamknięcie aplikacji w kwietniu 2026 roku i wyłączenie API do września pokazują, że cykl życia modeli generatywnej sztucznej inteligencji może być krótszy niż cykl sporów prawnych. Decyzja OpenAI kończy markę, ale nie kończy debaty — pytanie o prawa autorskie, transparentność i odpowiedzialność pozostanie aktualne wobec następców Sory. Sora zniknie, ale strukturalny problem AI-generowanego wideo pozostanie.