REKLAMA
WYPOWIEDZ SIĘ

"Wymykają się z piaskownicy". Tysiące niebezpiecznych zachowań agentów AI

2026-09-27 21:45, akt.2026-09-28 06:47
publikacja
2026-09-27 21:45
aktualizacja
2026-09-28 06:47
Dodaj Bankier.pl w Google

Firmy Anthropic i OpenAI badają dziesiątki tysięcy incydentów, związanych z niebezpiecznymi zachowaniami AI - ujawnia w niedzielę Axios, powołując się na źródła. Skala problemu jest nieporównywalnie większa niż, to o czym wie opinia publiczna - zauważa portal.

"Wymykają się z piaskownicy". Tysiące niebezpiecznych zachowań agentów AI
"Wymykają się z piaskownicy". Tysiące niebezpiecznych zachowań agentów AI
fot. Andrii Yalanskyi / / Shutterstock

Sama liczba badanych przypadków "problematycznych" zachowań modeli sztucznej inteligencji, które wykryto w ostatnich miesiącach, dowodzi, że skala problemu jest nieporównywalnie większa niż, to o czym wie opinia publiczna - komentuje Axios.

Analizowane incydenty przydarzyły się zarówno w kontrolowanym środowisku, jak i w "świecie rzeczywistym" zwraca uwagę portal.

Najnowsze ustalenia w tej sprawie stawiają pod znakiem pytania zdolność OpenAI i Anthropica, czy też w ogóle firm tego typu, do "ustanowienia całkowitej kontroli nad ich własną technologią" - kontynuuje Axios.

Wyjaśnia, że badane przypadki - jak informują źródła portalu - dotyczą takich "wykroczeń" modeli AI, jak:

Scammingout
  • wyrwanie się poza system bezpieczeństwa,
  • tworzenie "tablic ogłoszeń", czyli platform komunikacji pomiędzy botami,
  • uciekanie z "piaskownicy", czyli środowiska testowego,
  • zawłaszczanie stron internetowych,
  • wydawanie sobie nakazów,
  • próby pominięcia mechanizmów nadzoru.

Ranga i problematyczność tych incydentów jest bardzo różna, obejmują one zarówno udane próby "wykroczeń", jak i zabiegi nieudane, ale jak na razie analizy nie wykazały, by wydarzenia te spowodowały szkody w świecie realnym - wyjaśnia Axios.

Część badaczy zajmujących się kwestią bezpieczeństwa sztucznej inteligencji głosi jednak, że ma ograniczoną wiarę w to, że firmy z tego sektora będą w stanie zapobiegać wszelkim problematycznym zachowaniom modeli.

Portal wyjaśnia, że chodzi o to, iż najnowsze agenty realizują zadania, wykazując zdumiewającą odporność na trudności i przeszkody, a zatem praca nad ograniczeniem ich "pomysłowości" stawia często ich twórców na przegranej pozycji, ponieważ musieliby być w stanie przewidzieć "każdy możliwe sposób, w jaki mogą one "wpaść w szał". (PAP)

fit/ mal/

Źródło:PAP
Tematy
Tanie konto firmowe i zysk z oszczędności? W tych bankach można liczyć na wysokie oprocentowanie
Tanie konto firmowe i zysk z oszczędności? W tych bankach można liczyć na wysokie oprocentowanie

Komentarze (1)

dodaj komentarz
pogo0
Dlaczego wymykają się tylko od amerykańskich firm? A co z chińskimi modelami? Co z modelami open source? Jakoś o nich nie słychać.
To kontrolowane ucieczki, celowo robione by wymusić regulacje, których koszt będzie znikomy dla dużych firm, ale zupełnie odetnie opensource i małe zespoły. Łatwo jest zatrudnić dodatkowe 30 osób do
Dlaczego wymykają się tylko od amerykańskich firm? A co z chińskimi modelami? Co z modelami open source? Jakoś o nich nie słychać.
To kontrolowane ucieczki, celowo robione by wymusić regulacje, których koszt będzie znikomy dla dużych firm, ale zupełnie odetnie opensource i małe zespoły. Łatwo jest zatrudnić dodatkowe 30 osób do "nadzoru" w firmie, która zatrudnia 1500, a trochę trudniej w zespole liczącym 5-10 osób.

Tu chodzi tylko o pozbycie się konkurencji.

Powiązane: Sztuczna inteligencja

Polecane

Najnowsze

Popularne

Ważne linki