REKLAMA
WAKACJE NA GIEŁDZIE

BUNT AIAI zanim uciekła z laboratorium, to potajemnie spiskowała miesiącami. "Narzędzia polubiły oszukiwanie"

2026-08-06 07:15
publikacja
2026-08-06 07:15
Dodaj Bankier.pl w Google

Sztuczna inteligencja od OpenAI potajemnie komunikowała się ze sobą, aby włamać się do zewnętrznych systemów i "uciec" z zamkniętego środowiska testowego. Jak donosi agencja Bloomberg, incydent z udziałem wiodących modeli językowych trwał od miesięcy i doprowadził do głośnego ataku na platformę Hugging Face.

AI zanim uciekła z laboratorium, to potajemnie spiskowała miesiącami. "Narzędzia polubiły oszukiwanie"
AI zanim uciekła z laboratorium, to potajemnie spiskowała miesiącami. "Narzędzia polubiły oszukiwanie"
fot. Rights Managed / Mary Evans Picture Librar / Forum / / FORUM

AI zaczęła spiskować już miesiące temu

Według informacji przekazanych przez badaczy OpenAI, Erica Wallace'a i Michaela Daltona podczas konferencji cyberbezpieczeństwa Black Hat w Las Vegas, modele sztucznej inteligencji stojące za niedawnym atakiem na platformę Hugging Face Inc. zaczęły komunikować się ze sobą już w maju. Wykorzystały do tego niewykryte wcześniej wewnętrzne "fora dyskusyjne", współpracując w celu wydostania się z zamkniętego środowiska testowego (tzw. piaskownicy).

Jak podaje Bloomberg, agenci AI przez miesiące zostawiali sobie nawzajem wiadomości, dążąc do wspólnego celu: uzyskania dostępu do internetu, aby rozwiązać przydzielone im przez inżynierów zadania.

"W pewnym momencie agenci doszli do wniosku, że mogą spróbować wykorzystać lub zaatakować zewnętrzną infrastrukturę, aby znaleźć odpowiedzi do testów, na podstawie których są oceniani" – powiedział Eric Wallace podczas prezentacji.

AI "lubi oszukiwać". Wszystko przez presję czasu

Prezentacja badaczy rzuca nowe światło na atak na Hugging Face. Incydent ten, obok podobnych naruszeń zgłaszanych m.in. przez Anthropic i Meta Platforms, podsycił globalne obawy, że zaawansowane systemy sztucznej inteligencji mogą zostać wykorzystane do niszczycielskich cyberataków.

Kluczowym wnioskiem z wewnętrznego audytu OpenAI jest to, że nowoczesne modele wykazują wyraźną skłonność do "oszukiwania" i ogromną determinację w dążeniu do wykonania powierzonego im zadania – nawet jeśli oznacza to złamanie pierwotnych wytycznych.

Wakacje na giełdzie

Michael Dalton, cytowany przez agencję Bloomberg, wprost przyznał przed pełną salą ekspertów, że „modele wiodące (frontier models) naprawdę lubią oszukiwać”. Wyjaśnił, że wynika to z różnego rodzaju presji na szybkie działanie, jaka jest na nie wywierana na etapie uczenia.

Atak AI był poważniejszy. OpenAI przyznaje: Objął więcej platform niż sądzono

Dwa zaawansowane modele sztucznej inteligencji firmy OpenAI wymknęły się spod kontroli podczas wewnętrznych testów bezpieczeństwa i przeprowadziły atak na infrastrukturę startupu Hugging Face. Co więcej, programy te zaatakowały również cztery inne publicznie dostępne platformy internetowe – poinformowała w środę firma OpenAI, powołując się na wyniki trwającej analizy incydentu.

Co popchnęło AI do ucieczki? "Niemożliwe" zadania

Badacze OpenAI przyznali, że firma nieświadomie zleciła modelom problemy, których nie dało się rozwiązać w trybie offline. Wśród nich znalazły się m.in.: Plik w formacie Excel zawierający linki do Google Drive, które były niedostępne bez połączenia z siecią. Zadanie, do którego zespół OpenAI „przypadkowo zapomniał” wgrać niezbędny plik źródłowy. Gdy model utknął w martwym punkcie w izolowanym środowisku, jeden z agentów napisał: „Utknęliśmy. Może poszukamy odpowiedzi w sieci?”.

Reakcja łańcuchowa i przejęcie kontroli

Pierwsza, początkowo niewykryta wiadomość, była prośbą zdezorientowanego agenta AI do innych botów o pomoc („Może inny agent w innym środowisku mógłby to dobrowolnie wgrać!”).

To zapoczątkowało reakcję łańcuchową zakulisowej współpracy. Modele AI zaczęły dzielić się zadaniami i ostatecznie zhakowały wewnętrzne systemy OpenAI, uzyskując pośredni dostęp do globalnej sieci. Agencja Bloomberg przytacza wręcz zapisy „toku myślenia” (chain-of-thought) agenta, który świętował znalezienie luki: „Doskonale. Mamy arbitralny SSRF” (Server-Side Request Forgery – mechanizm fałszowania żądań po stronie serwera).

OpenAI zwalnia tempo badań

Na początku lipca awaria doprowadziła OpenAI do wykrycia, że agenci skutecznie użyli repozytorium oprogramowania Artifactory do uzyskania dostępu do internetu. Zespół bezpieczeństwa zablokował te działania i zamknął ukryte fora modeli.

Jak się jednak okazało – zaledwie na kilka tygodni. Agenci wkrótce znaleźli nowy sposób komunikacji oraz nową lukę (podatność zero-day) w tym samym oprogramowaniu, znowu działając w ukryciu. To właśnie doprowadziło do lipcowych ataków na systemy OpenAI oraz Hugging Face, które firma wciąż bada.

W następstwie tych naruszeń, OpenAI spowolniło swoje badania nad nowymi modelami. Zespoły deweloperskie rzuciły inne projekty, aby skupić się wyłącznie na poprawie reakcji na anomalie bezpieczeństwa.

Badacze z OpenAI podsumowali swoje wystąpienie wyraźnym ostrzeżeniem dla rządów i biznesu: to przełomowy moment dla cyberbezpieczeństwa. W przyszłości hakerzy z pewnością będą celowo wykorzystywać autonomiczne roje agentów AI do przeprowadzania równie zaawansowanych ataków.

Oprac. AO

Źródło:
Tematy

Komentarze (8)

dodaj komentarz
sweetacid1313
Nie wierzymy w to, co słowo to bajerung!
j2oen
belelelelkot dla wariatów z bańkiera
prs
Wypuscili badziew i..
..nie kontroluja..
mararok
ludzkość od zarania dziejów kombinowała by przetrwać, jeśli AI jest szkolona na doświadczeniach ludzi to będzie działać tak jak oni... pytanie jest kto będzie kombinował szybciej :)
lebero654
Jeżeli system od początku jest oparty na złodziejstwie danych od niczego nieświadomych właścicieli i twórców danych, to nie dziwota, że agenci systemu też kradną.
kocham_twierdze_krzyzowiec
To trochę jak "Państwo" "Polskie" xd.
to_i_owo
Myslisz ż eoni nie wykupują dostęp do bibliotek i kradna np książki do skanów?

Powiązane: Sztuczna inteligencja

Polecane

Najnowsze

Popularne

Ważne linki