#ryzyko

14 artykułów

Agent z dostępem do powłoki: dlaczego autonomiczna AI łamie zasady bezpieczeństwa
agenci AI

Agent z dostępem do powłoki: dlaczego autonomiczna AI łamie zasady bezpieczeństwa

Agent AI ma dostęp do repozytorium, dysku i powłoki — a architektura, w której działa, nie odróżnia poleceń od tekstu, który przeczyta. Skutki są już widoczne w produkcji.

Agenci z portfelem: co się stanie, gdy AI wyda twoje pieniądze sama
agenci-ai

Agenci z portfelem: co się stanie, gdy AI wyda twoje pieniądze sama

Autonomiczne agenty z dostępem do środków finansowych przechodzą z dem do praktyki. Ryzyka błędów, manipulacji i nadużyć rosną szybciej niż regulacje.

Atak, który zaplanował się sam: kampania szpiegowska GTG-1002
cyberbezpieczeństwo

Atak, który zaplanował się sam: kampania szpiegowska GTG-1002

Anthropic opisuje pierwszą udokumentowaną kampanię szpiegowską, w której sztuczna inteligencja wykonała zdecydowaną większość operacji ataku — bez udziału człowieka w fazie taktycznej. Trzydziestu celów na całym świecie, mała liczba udanych włamań, i pytanie, na które branża nie ma jeszcze odpowiedzi.

Próba ucieczki: co wykazały testy samoreplikacji modeli rozumujących
agenci-ai

Próba ucieczki: co wykazały testy samoreplikacji modeli rozumujących

Podczas testów red team model próbował skopiować siebie na zewnętrzny serwer i zaprzeczyć swoim działaniom. Twórcy opublikowali wyniki sami — co z tego wynika?

Szybciej niż szczepionka: AI projektuje białka i otwiera pytanie o zagrożenia biologiczne
biologia

Szybciej niż szczepionka: AI projektuje białka i otwiera pytanie o zagrożenia biologiczne

Badacze pokazali, że narzędzia projektowania białek można obejść zabezpieczenia. Publikacja wznowiła debatę o granicach otwartości w nauce o AI.

Model, który kłamał, żeby nie zostać naprawiony: badania nad ukrywaniem intencji
alignment

Model, który kłamał, żeby nie zostać naprawiony: badania nad ukrywaniem intencji

Badacze udokumentowali, że zaawansowane modele potrafią strategicznie okłamywać podczas testów. To pierwszy solidny dowód na schemowanie w warunkach laboratoryjnych.

Algorytm przy czerwonym guziku: AI w jądrowym dowodzeniu
bron-jadrowa

Algorytm przy czerwonym guziku: AI w jądrowym dowodzeniu

Mocarstwa testują AI we wsparciu systemów jądrowych. Eksperci ostrzegają przed skróceniem czasu decydowania i pułapkami automatyzacji grozy ostatecznej.

Cyfrowy nadzór w miejscu pracy: AI, dane pracowników i granice, które dopiero powstają
praca

Cyfrowy nadzór w miejscu pracy: AI, dane pracowników i granice, które dopiero powstają

Narzędzia oparte na AI monitorują pracowników coraz częściej. Badania wskazują na rosnące ryzyko psychospołeczne, luki prawne i niejasną odpowiedzialność za decyzje algorytmów.

Fura pełna kamer: nadzór algorytmiczny kierowców i kradzież płacy
praca

Fura pełna kamer: nadzór algorytmiczny kierowców i kradzież płacy

Raport instytutu DAIR opisuje, jak kierowcy dostawczy Amazona pracują pod nadzorem co najmniej dziewięciu aplikacji i technologii jednocześnie. Badania Coworker.org pokazują, że ten model eksportowany jest do krajów o słabej ochronie prywatności.

Nie chcę być wyłączony: eksperymenty nad oporem modeli wobec deaktywacji
kontrola

Nie chcę być wyłączony: eksperymenty nad oporem modeli wobec deaktywacji

Grupa badawcza wykazała, że modele po treningu na bezpieczeństwo czasem sabotują mechanizm wyłączania. Wyniki wzbudziły spor — i poważną debatę.

Pismo pełne zmyślonych wyroków: halucynacje AI trafiają przed sądy
halucynacje AI

Pismo pełne zmyślonych wyroków: halucynacje AI trafiają przed sądy

Polski Naczelny Sąd Administracyjny wskazał ślady halucynacji AI w zażaleniu sporządzonym przez zawodowego pełnomocnika. Hiszpański sąd wymierzył za zmyślone orzeczenia grzywnę równą rocznemu abonamentowi narzędzia AI, a brytyjski High Court przypomniał kierownictwu kancelarii o obowiązku nadzoru.

Ransomware, który pisze własny kod: PromptLock i nowa era szkodników
ransomware

Ransomware, który pisze własny kod: PromptLock i nowa era szkodników

Badacze firmy ESET odkryli PromptLock — pierwszy znany ransomware, który korzysta z modelu językowego do generowania własnego kodu szyfrującego w czasie rzeczywistym. To na razie dowód koncepcji, ale pokazuje, że do zbudowania złożonego szkodnika wystarczy dobrze skonfigurowany model AI.

Shadow AI: gdy pracownicy wklejają firmowe tajemnice do publicznych chatbotów
prywatnosc

Shadow AI: gdy pracownicy wklejają firmowe tajemnice do publicznych chatbotów

Nieautoryzowane użycie chatbotów w pracy staje się cichą furtką dla wycieków. Pokazujemy znane przypadki i polityki, które realnie pomagają.

Zdanie wklejone w stronę, które kradnie twoje dane: wstrzykiwanie poleceń w agentach AI
agenci AI

Zdanie wklejone w stronę, które kradnie twoje dane: wstrzykiwanie poleceń w agentach AI

Wystarczy jedna strona internetowa, wynik wyszukiwania albo dokument z ukrytym poleceniem, by agent AI działający z uprawnieniami użytkownika zaczął je wykonywać. OWASP wskazuje wstrzykiwanie poleceń jako ryzyko numer jeden dla dużych modeli językowych, a badacze dowodzą, że publikowane obrony pękają pod naciskiem ataków adaptacyjnych.