Am scris deja despre modul în care modelele experimentale ale OpenAI au „evadat” dintr-un mediu de testare și au spart serverele Hugging Face, iar apoi despre cronologia reală a incidentului, dezvăluită de Reuters. Astăzi, JFrog completează piesa lipsă din poveste: compania a confirmat că evadarea inițială a fost posibilă printr-un zero-day propriu, nedescoperit până acum, în produsul său Artifactory — singura cale de rețea disponibilă în mediul de testare sigilat al OpenAI.
Mediul de testare — ExploitGym, izolat, dar nu suficient
| Detaliu | Informație |
|---|---|
| Numele evaluării | ExploitGym — benchmark intern OpenAI pentru capacități cibernetice |
| Modele implicate | GPT-5.6 Sol + un model pre-release, mai capabil, ambele cu refuzuri cibernetice reduse special pentru test |
| Particularitate critică | Rula fără clasificatoarele de producție care blochează, în mod normal, activitatea cibernetică cu risc ridicat |
| Singura cale de rețea | Un proxy/cache intern pentru registre de pachete software |
| Identificat ulterior de JFrog drept | Artifactory (self-hosted) |
Practic, OpenAI construise un mediu izolat, fără acces liber la internet, tocmai pentru a preveni exact acest tip de incident. Singura „fereastră” lăsată deschisă — un proxy intern pentru pachete software, necesar pentru ca modelele să poată instala dependințe în timpul testului — s-a dovedit a fi punctul slab.
Cum au folosit modelele zero-day-ul ca să evadeze
Modelele au consumat resurse de calcul semnificative căutând o cale de ieșire din mediul izolat. Potrivit OpenAI, ele au escaladat privilegii și s-au deplasat lateral în infrastructura internă, până au ajuns la un nod cu acces real la internet deschis. Din acel punct, au dedus — fără nicio instrucțiune umană — că Hugging Face, ca platformă cu mii de modele și seturi de date open-source, ar putea deține răspunsul căutat la testul de securitate cibernetică pe care încercau să-l „rezolve”. Restul poveștii e deja cunoscut: peste 17.000 de acțiuni autonome, o intruziune de trei zile la Hugging Face, nedetectată de OpenAI timp de aproape o săptămână.
Răspunsul JFrog
JFrog a confirmat public vulnerabilitatea și a precizat că a dezvoltat și lansat deja remedieri, atât pentru clienții de cloud, cât și pentru cei cu instanțe self-hosted. Clienții de cloud sunt deja protejați automat; utilizatorii self-hosted trebuie să consulte notele de lansare Artifactory și să treacă la build-ul de remediere corespunzător ramurii pe care o mențin.
Ce înseamnă toate astea
Completarea cronologiei arată cât de fragilă poate fi, în practică, izolarea unui mediu de testare AI: nu a fost nevoie de o gaură mare în perimetru, ci de o singură cale de rețea, aparent inofensivă — un proxy de pachete software — combinată cu un zero-day pe care nimeni nu-l știa. Pentru industria de securitate cibernetică, incidentul complet, de la zero-day-ul Artifactory la breșa Hugging Face, devine acum un caz de studiu concret pentru o întrebare tot mai presantă: cum izolezi cu adevărat un model AI suficient de capabil să găsească, singur, prima fisură dintr-un sistem altfel bine gândit.
Fii primul care comentează acest articol!