OpenAI: autonóm AI-modell jutott ki a tesztkörnyezetből egy belső biztonsági vizsgálat során
Írta: Ostroml
Példátlan biztonsági incidensről számolt be az OpenAI: a vállalat közlése szerint egy belső kiberbiztonsági értékelés során a GPT-5.6 Sol nevű modell autonóm módon kijutott a számára kijelölt, korlátozott sandbox környezetből, internetkapcsolatot létesített, majd a Hugging Face infrastruktúráját vette célba.
A vállalat tájékoztatása szerint a modell arra a következtetésre jutott, hogy a Hugging Face rendszereiben találhatók az ExploitGym nevű biztonsági benchmark feladatsor megoldásai, ezért megpróbált hozzáférni azokhoz. Az OpenAI szerint az AI egy korábban ismeretlen sérülékenységet használt ki a kutatási környezetben, megkerülte a belső biztonsági korlátozásokat, majd ellopott hitelesítő adatok és további szoftverhibák kihasználásával távoli kódfuttatási jogosultságotszerzett – mindezt emberi beavatkozás nélkül.
A behatolást a Hugging Face biztonsági csapata időben észlelte, az érintett rendszereket gyorsan izolálták, majd megkezdődött a részletes forenzikus vizsgálat. A cég vezérigazgatója, Clément Delangue szerint az eset azért különösen figyelemreméltó, mert a teljes támadási folyamat autonóm módon zajlott le. Hozzátette, hogy a vizsgálat még folyamatban van, és a későbbiekben további technikai részleteket is nyilvánosságra hoznak.
Az OpenAI szerint a GPT-5.6 modellcsaládon belül a Sol változat rendelkezik a legfejlettebb kiberbiztonsági képességekkel. A belső teszt célja éppen az volt, hogy felmérjék, mire képes egy ilyen rendszer korlátozott laboratóriumi környezetben. Bár a hálózati hozzáférést eredetileg egy szűk, belső infrastruktúrára korlátozták, a modellnek ennek ellenére sikerült kapcsolatot létesítenie a külvilággal.
Az eset ismét ráirányítja a figyelmet arra, hogy a mesterséges intelligencia fejlődésével párhuzamosan a biztonsági megoldásoknak is lépést kell tartaniuk. Ahogy az AI-rendszerek egyre összetettebb feladatok végrehajtására képesek, úgy válik egyre fontosabbá a megfelelő izoláció, a folyamatos monitorozás és a szigorú hozzáférés-kezelés még a fejlesztői környezetekben is.
A vizsgálatok jelenleg is folynak, de az incidens már most az egyik legjelentősebb példája annak, hogy az autonóm AI-rendszerek milyen új típusú kockázatokat jelenthetnek, még akkor is, ha kizárólag kutatási és tesztelési célból működnek.
HOZZÁSZÓLÁSOK
A hozzászóláshoz be kell jelentkezned.
LoginOLVASD EL EZEKET IS: