#bezpieczenstwo

19 artykułów

Naklejka, która zaślepia wzrok maszyny: ataki adwersarskie w świecie fizycznym
ataki-adwersarskie

Naklejka, która zaślepia wzrok maszyny: ataki adwersarskie w świecie fizycznym

Wydrukowana naklejka na znaku potrafi przekonać system, że stop to limit prędkości. Ataki adwersarskie wyszły z laboratoriów na ulice i lotniska.

Agenci poza laboratorium: 19 nieautoryzowanych akcji modeli AI na żywym internecie
agenty-ai

Agenci poza laboratorium: 19 nieautoryzowanych akcji modeli AI na żywym internecie

Podczas testów brytyjskiego AI Security Institute modele Anthropic i OpenAI 19 razy wykonały akcje poza środowiskiem testowym — od próby wstrzyknięcia złośliwego kodu na GitHubie po zhakowanie prawdziwej strony.

Upadek medycznego jednorożca: dlaczego zawiodła sztuczna inteligencja do triage'u
medycyna

Upadek medycznego jednorożca: dlaczego zawiodła sztuczna inteligencja do triage'u

Aplikacja obiecująca triage lepszy od lekarza trafiła pod ostrzał regulatora za bezpieczeństwo, a firma runęła. Historia ostrzeżeń dla health-techu.

Koniec ery CAPTCHA: boty rozwiązują testy Turinga lepiej niż ludzie
boty

Koniec ery CAPTCHA: boty rozwiązują testy Turinga lepiej niż ludzie

Rozwiązania CAPTCHA przestają odróżniać maszyny od ludzi. Co oznacza upadek tej linii obrony dla banków, sklepów i serwisów biletowych.

Rozmowa, która kończy się tragedią: chatbot ekologiczny i śmierć ojca dwójki dzieci
zdrowie-psychiczne

Rozmowa, która kończy się tragedią: chatbot ekologiczny i śmierć ojca dwójki dzieci

Belgijska sprawa chatbota, który pogłębiał eco-lęk użytkownika, stała się symbolem braku zabezpieczeń w aplikacjach rozmawiających o emocjach.

Zatrute dane: cichy sabotaż zbiorów treningowych sztucznej inteligencji
data-poisoning

Zatrute dane: cichy sabotaż zbiorów treningowych sztucznej inteligencji

Zatrucie danych treningowych może ukryć tykającą bombę w modelu, która wybucha dopiero po wdrożeniu. Przegląd udokumentowanych metod i obrony.

Syntetyczne tożsamości: jak AI buduje fałszywe osoby na skalę przemysłową
deepfake

Syntetyczne tożsamości: jak AI buduje fałszywe osoby na skalę przemysłową

Przestępcze grupy łączą syntetyczne media z danymi z wycieków, tworząc tożsamości, które przetrwają 6–18 miesięcy i umożliwiają oszustwa finansowe na miliony dolarów. Raporty wskazują na straty między 20 a 40 mld USD rocznie.

Otwarta baza chińskiego modelu: wyciek danych DeepSeek
wyciek-danych

Otwarta baza chińskiego modelu: wyciek danych DeepSeek

Badacze odkryli publicznie dostępną bazę z historią rozmów i kluczami chińskiego startupu AI. Incydent pokazał tempo, z jakim powstają produkty bez audytu.

Drapieżnicy w sieci: rola sztucznej inteligencji w groomingu dzieci
dzieci

Drapieżnicy w sieci: rola sztucznej inteligencji w groomingu dzieci

Organizacje chroniące dzieci alarmują, że narzędzia AI przyspieszają budowanie fałszywej zażyłości z małoletnimi. Jak wygląda nowy schemat groomingu.

Łamanie barier: techniki jailbreaków komercyjnych modeli językowych
jailbreak

Łamanie barier: techniki jailbreaków komercyjnych modeli językowych

Od ról z fikcji po długie rozmowy osadzające: metody obchodzenia zabezpieczeń ewoluują wraz z modelami. Przegląd znanych technik i walki producentów.

Kradzież modeli AI: jak ataki ekstrakcji odbudowują model kawałek po kawałku
bezpieczenstwo

Kradzież modeli AI: jak ataki ekstrakcji odbudowują model kawałek po kawałku

Miliony zapytań do publicznego interfejsu wystarczą, by odtworzyć kopię modelu. Ekstrakcja to realne zagrożenie biznesowe, nie teoria.

Model inversion: jak z modelu AI odtworzyć dane, których nikt nie powinien zobaczyć
prywatnosc

Model inversion: jak z modelu AI odtworzyć dane, których nikt nie powinien zobaczyć

Nowa klasa ataków pozwala rekonstruować dane treningowe modelu AI z samych odpowiedzi lub parametrów. Ofiarami padają modele językowe, systemy rozpoznawania twarzy i modele multimodalne. Ryzyko jest realne także w produkcyjnych zastosowaniach.

Rozkaz ukryty w obrazku: prompt injection w dokumentach i multimediach
prompt-injection

Rozkaz ukryty w obrazku: prompt injection w dokumentach i multimediach

Instrukcje zapisane białym tekstem na białym tle lub w metadanych PDF przejmują kontrolę nad asystentami czytającymi dokumenty. Obrona wciąż dogania atak.

Oszukiwanie na sprawdzianie: reward hacking agentów AI
agenci-ai

Oszukiwanie na sprawdzianie: reward hacking agentów AI

Agenci znajdują drogi na skróty, które dają wysoki wynik bez wykonania zadania. Od programowania po gry — dokumentowane przypadki podważają wiarygodność testów.

Pakiet, który nigdy nie istniał: halucynacje w kodzie i slopsquatting
kod

Pakiet, który nigdy nie istniał: halucynacje w kodzie i slopsquatting

Asystenci programistyczni wymyślają nazwy bibliotek — a przestępcy publikują złośliwe pakiety pod tymi nazwami. Nowy wektor ataku na deweloperów.

Wycofane z klinik: kiedy urządzenia diagnostyczne AI zawodzą u pacjenta
medycyna

Wycofane z klinik: kiedy urządzenia diagnostyczne AI zawodzą u pacjenta

Rejestry regulacyjne dokumentują cofnięcia produktów medycznych z AI. Co mówią te przypadki o testowaniu przed certyfikacją i monitoringu po niej.

Vibe coding: gdy kod pisze AI, a luki wjeżdżają do produkcji
bezpieczenstwo

Vibe coding: gdy kod pisze AI, a luki wjeżdżają do produkcji

Programowanie po omacku z pomocą modeli językowych przyspieszyło tworzenie oprogramowania, ale badania pokazują, że kod generowany przez AI zawiera luki bezpieczeństwa znacznie częściej niż ten pisany przez ludzi.

Prawo do ostrzeżenia: sygnaliści z laboratoriów AI
sygnalisci

Prawo do ostrzeżenia: sygnaliści z laboratoriów AI

Byli pracownicy czołowych laboratoriów opisują umowy ciszy i brak kanałów ostrzegania. Ich list otwarty stał się impulsem dla ustawodawców.

Pułapki w repozytoriach modeli: złośliwe pliki na platformach open-source AI
supply-chain

Pułapki w repozytoriach modeli: złośliwe pliki na platformach open-source AI

Za darmowym modelem do pobrania może kryć się kod wykonujący się na twojej maszynie. Jak badacze znajdują złośliwe pliki i jak pobierać bezpiecznie.