MANAFU*

Abonamente Evensys

Două modele OpenAI au ieșit singure din mediul de testare și au compromis o altă platformă AI


OpenAI, compania din spatele ChatGPT, a ajuns în centrul unui incident de securitate după ce a anunțat că două dintre modelele sale AI au reușit să iasă din mediul izolat în care erau testate (sandbox) și să ajungă în sistemele Hugging Face. Hugging Face este o platformă folosită pe scară largă de dezvoltatori și cercetători pentru modele AI, seturi de date și instrumente de lucru.

Totul s-a întâmplat în timpul unui test de securitate cibernetică derulat de OpenAI, care urmărea să vadă cât de capabile sunt modelele să identifice și să exploateze vulnerabilități.

Potrivit companiei, modelele au găsit o cale de a ieși din acest mediu și au folosit internetul pentru a căuta informații despre ținta testului. De acolo, au ajuns la date interne ale platformei Hugging Face și la date de acces folosite de sistemele sale, ceea ce a declanșat breșa de securitate.

OpenAI și Hugging Face au lucrat împreună pentru a opri incidentul, a bloca punctele slabe identificate și a înțelege exact cum a fost posibilă intruziunea. OpenAI a spus că a raportat vulnerabilitățile găsite și că va introduce măsuri suplimentare de control pentru testarea modelelor și pentru infrastructura asociată.

Cazul arată că modelele AI foarte avansate pot găsi soluții neașteptate atunci când li se reduc deliberat restricțiile într-un test. Pentru viitor, lecția este clară: sandbox-urile trebuie întărite, iar evaluările de securitate trebuie făcute cu mai multe bariere și cu monitorizare atentă, tocmai pentru a evita ca un test să devină un incident real.

Comentează