Perplexity AI i spór o pobieranie treści: odpowiedzi AI zamiast linków, pozwy mediów i blokady Cloudflare

Perplexity AI i spór o pobieranie treści: odpowiedzi AI zamiast linków, pozwy mediów i blokady Cloudflare

Perplexity AI: odpowiedź zamiast linku

Perplexity AI, Inc. to amerykańska spółka prywatna z siedzibą w San Francisco, która udostępnia internetową wyszukiwarkę określaną mianem „answer engine” — silnika odpowiedzi. Zamiast zwracać użytkownikowi listę linków do kliknięcia, system przetwarza zapytanie w języku naturalnym, samodzielnie przegląda wyniki wyszukiwania, a następnie syntetyzuje jedną spersonalizowaną odpowiedź, podając przypisy do źródeł, z których korzystał. To fundamentalne odwrócenie paradygmatu klasycznej wyszukiwarki: użytkownik nie musi czytać dziesięciu stron, aby zrozumieć jedno zagadnienie — czyta jeden wygenerowany akapit.

Firma została założona w sierpniu 2022 roku przez czterech współzałożycieli: Aravinda Srinivasa, Denisa Yaratsa, Johnny’ego Ho oraz Andy’ego Konwinskiego. Jak odnotował TechCrunch już 9 grudnia 2022 roku, zespół pochodził ze środowisk badawczych dużych firm technologicznych i przyszedł z koncepcją wyszukiwarki zorganizowanej wokół modelu językowego, a nie listy wyników. Premiera głównej wyszukiwarki odbyła się w grudniu 2022 roku — stosunkowo skromnie na tle boomu na generatywną AI, który nastąpił nieco później.

Backend usługi, określany nazwą Sonar, jest oparty na modelu Llama firmy Meta, co oznacza, że Perplexity nie szkoli własnego proprietarnego modelu fundamentalnego od zera, lecz buduje na udostępnionych przez Meta wagach i dostosowuje je do swoich potrzeb. Interfejs usługi działa w modelu freemium — istnieje darmowa wersja podstawowa oraz subskrypcyjna wersja Pro dla użytkowników wymagających większej liczby zapytań i dostępu do potężniejszych modeli zaplecza.

Mechanika: model językowy plus pobieranie treści sieci

Aby odpowiedź pojawiała się dla użytkownika, musi zostać wygenerowana w czasie rzeczywistym z aktualnymi danymi. Rola pobierania treści — automatycznego pobierania treści ze stron internetowych — jest tutaj kluczowa. Gdy użytkownik zadaje pytanie, Perplexity wysyła do sieci web crawlers — programy pobierające treść stron. Pobrany tekst jest następnie przekazywany do modelu językowego jako kontekst, na podstawie którego generowana jest syntetyczna odpowiedź.

Mechanik tej operacji stał się jednym z najbardziej kontrowersyjnych elementów działalności firmy. Zgodnie z analizą przeprowadzoną przez magazyn Wired oraz dostawcę infrastruktury Cloudflare, Perplexity wykorzystywał web crawlers o spoofowanych user-agent strings — czyli o nagłówkach HTTP fałszywie przedstawiających się jako przeglądarka innego typu, czasami jako jeden z powszechnie używanych klientów, często ukrywających rzeczywistą identyfikację bota. W praktyce oznacza to, że rachunki rozpoznające boty po nagłówkach User-Agent mogą nie rozpoznać crawlera Perplexity i potraktować go jak zwykłego użytkownika z przeglądarką.

Kontrowersyjność tego podejścia potęguje fakt, że crawler pobierał treść także z stron, które wyraźnie blokowały web scraping — na przykład poprzez plik robots.txt lub instrukcje meta noindex. W tradycyjnej etyce internetowej takie instrukcje są sygnałem, że właściciel strony nie życzy sobie automatycznego pobierania jej treści. Omijanie tych blokad poprzez maskowanie tożsamości crawlera jest postrzegane przez wielu wydawców jako naruszenie niepisanej umowy, która sprawiała, że sieć funkcjonowała względną przewidywalnością.

Od miliarda do dwudziestu miliardów: wzrost i finansowanie

Wzrost wartości Perplexity był szybki i głośno komentowany przez rynek. W kwietniu 2024 roku — jak donosił Bloomberg 23 kwietnia — firma pozyskała 165 mln USD finansowania i osiągnęła wycenę powyżej 1 mld USD. Wśród inwestorów znaleźli się jednostki o znaczeniu strategicznym: Jeff Bezos, współzałożyciel Shopify Tobias Lütke, były CEO GitHub Nat Friedman, a także prywatne spółki Nvidia i Databricks. Obecność Nvidii na liście inwestorów jest istotna, ponieważ odpowiada za dostarczanie infrastruktury GPU niezbędnej do działania modelu zaplecza.

Aż 12 maja 2025 roku Bloomberg odnotował rundę 500 mln USD, która podniosła wycenę do 14 mld USD. Niecałe cztery miesiące później, 11 września 2025 roku, Reuters doniósł, że wycena spółki osiągnęła 20 mld USD. Do grona inwestorów dołączył 30 września 2025 roku 1789 Capital — fundusz powiązany z Donaldem Trumpem juniorem, jak donosił Reuters.

Skala wykorzystania usługi rosła równolegle. Jak odnotował TechCrunch 5 czerwca 2025 roku, na Bloomberg Tech Summit 2025 ogłoszono, że Perplexity obsłużył 780 mln zapytań w maju 2025 roku — średnio 30 mln dziennie. Firma sięgała też po media: 12 sierpnia 2025 roku złożył niesollicytowaną ofertę zakupu Google Chrome za 34,5 mld USD, jak odnotowały The Verge i WSJ.

Początek 2026 roku przyniósł wycenę 21,21 mld USD po rundzie Series E-6 oraz 3-letnie zobowiązanie na 750 mln USD z Microsoft Azure na dostęp do GPU.

Pozwy mediów: NYT, BBC, Dow Jones

Sposób zdobywania treści wywołał jednak falę konfliktów z wydawcami. Na drodze do Perplexity trafiły pozy lub cease-and-desist — formalne żądania zaprzestania naruszeń — od znaczących brandów medialnych: The New York Times, BBC oraz Dow Jones (wydawcy m.in. The Wall Street Journal). Jak relacjonuje TechTarget oraz neuron.expert, wszyscy trzej wydawcy zarzucali Perplexity wykorzystywanie chronionych prawem autorskim materiałów bez licencji.

W szczególności The New York Times wysłał cease-and-desist — decyzja szczególnie symboliczna, ponieważ ten sam wydawca wytoczył wcześniej pozwy OpenAI i Microsoftowi za wykorzystanie materiałów do trenowania modeli. Zarysowała się istotna różnica: o ile trening modelu fundamentalnego jest procesem abstrakcyjnym, o tyle pobieranie treści w czasie rzeczywistym i publikowanie ich syntetyzowanej wersji bezpośrednio konkuruje z wydawcą — użytkownik otrzymuje jego zawartość bez wchodzenia na jego stronę.

W odpowiedzi na oskarżenia o plagiat Perplexity uruchomił w lipcu 2024 roku program publishers’ program — program, który dzielić się miał przychodem z reklamy z wydawcami, gdy odpowiedź korzystała z ich treści. Jak donosił The Verge 30 lipca 2024 roku, program miał być reakcją na krytykę i ugodą z rynkiem. Nie zakończył jednak konfliktu — pozy kolejnych wydawców postępowały dalej.

Przełom: model subskrypcyjny z lutego 2026

Decydujący zwrot nastąpił 18 lutego 2026 roku. Jak donosił MacRumors, Perplexity ogłosił przejście na model subskrypcyjny i porzucenie strategii reklamowej opartej na AI. Decyzja była argumentowana dążeniem do zachowania zaufania użytkownika — rosnąca krytyka pobierania treści i pozwów sprawiała, że przychody z reklam sieciowych stały się kwestią reputacyjną, nie tylko biznesową.

Przejście na subskrypcje ma istotny sens dla wydawców, którzy postrzegają Perplexity jako konkurenta: zamiast czerpać przychody z reklam, które w klasycznym modelu trafiają do wydawców, Perplexity staje się platformą, którą użytkownik opłaca bezpośrednio. To zmienia równowagę w debacie o prawie autorskim — skoro Perplexity przestał być platformą reklamową, argument o zakłócaniu rynku reklamowego wydawców traci na ostrości. Pozostaje jednak pytanie, czy subskrypcje zostaną dzielone z wydawcami podobnie jak program reklamowy z 2024 roku.

Wnioski dla ekosystemu

Przypadek Perplexity AI ujawnia strukturalne napięcia w architekturze internetu. Platforma, która obiecuje syntetyzować odpowiedź zamiast odsyłać do źródeł, de facto zakłóca status quo, w którym wydawcy utrzymują się z ruchu użytkowników. Web crawlers występujące z spoofowanych nagłówków User-Agent —maskujące się jako zwykli użytkownicy — wprowadzają dodatkową warstwę niejawności w relacji platforma-wydawca.

Pozwy NYT, BBC i Dow Jones stanowią test przypadków dla interpretacji prawa autorskiego w erze generatywnej AI. W odróżnieniu od sporów o trening modeli fundamentalnych, gdzie kopia jest abstrakcyjna, odpowiedź answer engine prezentuje użytkownikowi treść w sposób konkurencyjny wobec oryginalnego artykułu. Decyzja z lutego 2026 roku o porzuceniu modelu reklamowego sugeruje, że rynkowe rozwiązanie może częściowo zastąpić regulacyjne — pytanie pozostaje, czy dobrowolne przejście na subskrypcje wystarczy, aby załagodzić konflikty z wydawcami.

Na 8 sierpnia 2026 roku Perplexity jest spółką o wycenie powyżej 21 mld USD, obsługującą miliony zapytań dziennie, z backendem opartym na open-source’owym modelu Llama i pozwalającą sobie na niesollicytowane oferty zakupu Chrome. Nadal jednak nie rozstrzygnięto fundamentalnego pytania: czy maszynowe przerabianie treści w jedną odpowiedź jest nową formą wyszukiwania, czy nową formą wydawania — i kto ma z tego czerpać korzyści.

Czytaj dalej

Deepfake w sądzie: gdy fałszywe nagranie staje się dowodem

Deepfake w sądzie: gdy fałszywe nagranie staje się dowodem

Znaki wodne i metadane C2PA nie ochronią Cię przed fałszywką

Znaki wodne i metadane C2PA nie ochronią Cię przed fałszywką

Quishing: phishing, który chowa się za kodem QR

Quishing: phishing, który chowa się za kodem QR

Fabryka uczuć: gdy oszuści używają sztucznej inteligencji do budowania zaufania

Fabryka uczuć: gdy oszuści używają sztucznej inteligencji do budowania zaufania