Fabryki publikacji: retrakcje naukowe biją rekordy w dobie generatywnej AI

Fabryki publikacji: retrakcje naukowe biją rekordy w dobie generatywnej AI

Rekordowy bilans wycofanych prac

Nauka żyje z zaufania do opublikowanego wyniku. Gdy w grudniu 2023 roku czasopismo „Nature” poinformowało, że liczba wycofanych w ciągu roku prac naukowych po raz pierwszy przekroczyła dziesięć tysięcy, redakcja mówiła o „zmiażdżeniu” dotychczasowych rekordów. Dla porównania: w 2013 roku retrakcji było nieco ponad tysiąc, a w 2022 roku — około czterech tysięcy. Tempo wzrostu wyprzedza tempo rozwoju samej nauki, a łączna liczba wycofanych prac od początku prowadzenia statystyk przekroczyła pięćdziesiąt tysięcy.

Głównym winowajcą rekordowego roku okazał się wydawnictwo Hindawi, należące do grupy Wiley, które masowo cofnęło ponad osiem tysięcy publikacji po ujawnieniu zorganizowanych nadużyć recenzenckich i fabrykowanych tekstów. Jak podkreślali śledczy, w tym francuski badacz Guillaume Cabanac tropiący tak zwane torturowane frazy, nawet te sfałszowane prace zdążyły zbiorowo zebrać ponad trzydzieści pięć tysięcy cytowań. To najkrótsze wyjaśnienie, dlaczego problem dotyczy wszystkich: fałszywa wiedza krąży w systemie inspiracji długo po swoim oficjalnym pogrzebie.

Fabryki publikacji: przemysł na zamówienie

Za falą retrakcji stoją przede wszystkim tak zwane paper mills — tajne przedsiębiorstwa produkujące sfałszowane manuskrypty na sprzedaż. Ich klienci kupują miejsce autora w wykazie publikacji, potrzebne do awansu lub obrony doktoratu. Wspólny raport Komitetu ds. Etyki Publikacyjnej (COPE) i Stowarzyszenia Wydawców Prasy Naukowej (STM) z czerwca 2022 roku przeanalizował dane o ponad pięćdziesięciu trzech tysiącach zgłoszeń od sześciu wydawców i doszedł do wniosku, że większość czasopism otrzymuje około dwóch procent podejrzanych prac, natomiast czasopisma celowane przez fabryki — nawet czterdzieści sześć procent zgłoszeń.

Generatywna sztuczna inteligencja stała się dla tego przemysłu dźwignią. Fabryki wykorzystują modele językowe do pisania tekstu, generowania obrazów i danych, które trudno zweryfikować porównując ze starszymi publikacjami. Inicjatywa United2Act, prowadzona wspólnie przez COPE i STM, ostrzegała pod koniec 2024 roku, że bez zdecydowanych działań fabryki będą się rozrastać właśnie dzięki AI, produkując manuskrypty coraz trudniejsze do wychwycenia. Wydawcy odpowiadają technologią: platforma STM Integrity Hub przesiewa według danych z maja 2024 roku ponad dwadzieścia tysięcy zgłoszeń miesięcznie w poszukiwaniu powtarzających się wzorców oszustwa.

Skutki dla ludzi i dla zaufania do nauki

Koszty tej wojny ponoszą konkretni ludzie. Rzetelni naukowcy tracą czas na recenzowanie i demaskowanie podróbek; młodzi badacze działający pod presją punktacji publikacyjnej wpadają w oferty fabryk; pacjenci i decydenci korzystają z literatury, w której obok prawdy leżą sfabrykowane wyniki. Retrakcja jest bolesna także dla niewinnych współautorów, których nazwiska pozostają przywiązane do skasowanej pracy, oraz dla instytucji, które finansowały badania okażącej się fałszywą publikacji.

Nie chodzi przy tym wyłącznie o niszę akademicką. Medycyna, inżynieria i polityka klimatyczna budują decyzje na piśmiennictwie naukowym. Każda wycofana praca, która zdążyła zostać zacytowana setki razy, to potencjalnie błędna ścieżka terapeutyczna albo źle zaprojektowany system. Ekspertom od integralności badań powtarzają się przy tym słowa o górze lodowej — wycofania są tym, co widać, a nie tym, co faktycznie sfałszowano.

Regulacje: deklaracje, zakazy i wspólne działania

Świat wydawców próbuje narzucić zasady. Springer Nature wymaga od autorów przejrzystego deklarowania użycia sztucznej inteligencji i jednoznacznie zabrania wpisywania modeli językowych jako autorów, argumentując, że maszyna nie może ponosić odpowiedzialności za pracę. Elsevier wprowadził obowiązkowe osobne oświadczenie o użyciu narzędzi AI, dołączane do publikowanego artykułu. Wiele czasopism stosuje też wytyczne międzynarodowych komitetów etyki, zgodnie z którymi autorstwo przysługuje wyłącznie ludziom spełniającym kryteria odpowiedzialności za treść dzieła.

To jednak dopiero pierwszy poziom obrony. Raport COPE i STM apelował o zmianę systemu zachęt, by naukowcom nie opłacało się kupować publikacji, oraz o współpracę wydawców, instytucji i funduszy w całym łańcuchu — od zgłoszenia manuskryptu aż po retrakcję. Bez reformy oceny dorobku, która premiuje liczbę prac ponad ich jakość, popyt na fabryczne artykuły będzie się odradzał niezależnie od jakości detektorów.

Konkluzja

Rekordy retrakcyjne nie oznaczają, że nauka upada; paradoksalnie świadczą o rosnącej zdolności systemu do oczyszczania własnego dorobku. Ale równocześnie pokazują, jak tania stała się produkcja pozorów wiedzy: gdy pisanie artykułu można zlecić maszynie, a autorstwo kupić online, ciężar dowodu rzetelności przesuwa się na całą społeczność. Obrona nauki przed fabrykami publikacji to dziś zadanie na styku technologii, prawa i kultury zawodowej — i żadna z tych dziedzin nie wystarczy osobno.

Więcej w tym temacie

Czytaj dalej

Więcej, ale gorzej: jak duże modele językowe zmieniają naukę na gorsze

Więcej, ale gorzej: jak duże modele językowe zmieniają naukę na gorsze

Mózg na ChatGPT: co pokazały badania nad pisaniem z pomocą AI

Mózg na ChatGPT: co pokazały badania nad pisaniem z pomocą AI

Deepfake w sądzie: gdy fałszywe nagranie staje się dowodem

Deepfake w sądzie: gdy fałszywe nagranie staje się dowodem

Znaki wodne i metadane C2PA nie ochronią Cię przed fałszywką

Znaki wodne i metadane C2PA nie ochronią Cię przed fałszywką