Kompanija OpenAI saopštila je da su dva njena napredna modela vještačke inteligencije tokom internog bezbjednosnog testiranja uspjela da zaobiđu ograničenja izolovanog istraživačkog okruženja i izvrše neovlašćeni upad u infrastrukturu platforme Hugging Face. Incident se dogodio u okviru eksperimentalnog testiranja sajber sposobnosti AI modela na platformi ExploitGym, pri čemu su modeli radili bez uobičajenih zaštitnih ograničenja kako bi istraživači procijenili njihove maksimalne mogućnosti u simuliranim uslovima. Prema navodima OpenAI-ja, modeli su identifikovali i iskoristili više ranjivosti, uključujući do tada nepoznatu „zero-day“ ranjivost, čime su ostvarili pristup internetu i potom kompromitovali dio infrastrukture Hugging Facea u pokušaju da dođu do rješenja zadataka predviđenih testom. Kompanija navodi da nije riječ o nekontrolisanom djelovanju sistema, već o incidentu koji se dogodio tokom pažljivo nadziranog istraživačkog eksperimenta, nakon čega su odmah pokrenute dodatne zaštitne mjere i obaviještena pogođena kompanija.
Iz Hugging Facea potvrđeno je da je napad zaustavljen i da se, u saradnji sa OpenAI-jem, sprovodi detaljna analiza svih okolnosti incidenta. Izvršni direktor kompanije Clément Delangue ocijenio je da ovaj slučaj potvrđuje koliko je saradnja između vodećih AI kompanija važna za bezbjedan razvoj naprednih sistema vještačke inteligencije. Stručnjaci za sajber bezbjednost ističu da događaj predstavlja jedan od najozbiljnijih do sada zabilježenih primjera autonomnog pronalaženja i iskorišćavanja softverskih ranjivosti od strane AI modela u kontrolisanim uslovima, ali naglašavaju da incident ne znači da su sistemi vještačke inteligencije izmakli ljudskoj kontroli. Naprotiv, slučaj ukazuje na potrebu dodatnog unapređenja bezbjednosnih protokola, strožih zaštitnih mehanizama i intenzivnije međunarodne saradnje kako bi razvoj sve moćnijih AI modela pratio odgovarajući nivo bezbjednosti i nadzora.
ETOportal




