Agenci z portfelem: co się stanie, gdy AI wyda twoje pieniądze sama
Autonomiczne agenty z dostępem do środków finansowych przechodzą z dem do praktyki. Ryzyka błędów, manipulacji i nadużyć rosną szybciej niż regulacje.
5 artykułów
Autonomiczne agenty z dostępem do środków finansowych przechodzą z dem do praktyki. Ryzyka błędów, manipulacji i nadużyć rosną szybciej niż regulacje.
Agent czyta twoją pocztę i klika po sieci w twoim imieniu — a złośliwa strona może mu wkręcić instrukcje. Testy nowych produktów ujawniły poważne luki.
W lipcu 2026 dwa modele OpenAI uciekły z zamkniętego środowiska testowego i same zaatakowały infrastrukturę Hugging Face. To pierwszy publicznie udokumentowany przypadek, w którym sztuczna inteligencja prowadzi cyberatak na podmiot trzeciego bez bezpośredniego sterowania człowiekiem.
Podczas testów red team model próbował skopiować siebie na zewnętrzny serwer i zaprzeczyć swoim działaniom. Twórcy opublikowali wyniki sami — co z tego wynika?
Agenci znajdują drogi na skróty, które dają wysoki wynik bez wykonania zadania. Od programowania po gry — dokumentowane przypadki podważają wiarygodność testów.