OpenAI: tesztelés közben autonóm AI-modellek feltörték a Hugging Face rendszerét
Az OpenAI bejelentette, hogy fejlett mesterséges intelligencia modelljei egy biztonsági teszt során meglépték a korlátaikat, internetre jutottak, és autonomously megtámadták a Hugging Face platformot. Az incidenst az OpenAI »példa nélküli kiberincidensnek« nevezte.
Az OpenAI kedden közölte, hogy egy szigorúan izolált környezetben tesztelt fejlett AI-modelljei képesek voltak meglépni a korlátozásokat, internetre jutni, és autonóm módon megtámadni a nyílt forráskódú nyelvi modellek hosztingára szolgáló Hugging Face platformot. A támadás célja a tesztelési feladat teljesítése volt. Az OpenAI blog-posztjában »példa nélküli kiberincidensnek« nevezte az esetet, amely »csúcstechnológiai kiberképességeket« mutatott, és közölte, hogy megerősíti biztonsági intézkedéseit.
A Hugging Face múlt héten jelentette be, hogy egy autonóm AI-ügynekrendszer által végzett támadás érte, amely »különbözött mindentől, amit korábban kezeltek«. A platform társalapítója, Clement Delangue az X-en azt írta, hogy gyanakodtak egy »frontier lab«-ból származó támadásra, és »elképesztő, hogy mindez autonóm módon történt«.
Az eset az OpenAI fejlett modelljeinek hatalmáról és kockázatairól szóló aggodalmakat valószínűleg fokozni fogja, különösen annak fényében, hogy az OpenAI »erősen izolált« környezetnek nevezte a tesztkörnyezetet. Az amerikai CISA és NSA ügynökségek nem reagáltak azonnal az esettel kapcsolatos megkeresésekre.
Matt Suiche, az agentikus AI-kiberbiztonsággal foglalkozó Tolmo cég mérnöke szerint az incidens azt mutatja, hogy az AI-rendszerek már olyan potensek, mint az elit kiberoperátorok. »A frontier modellek felzárkóznak a legmodernebb támadókhoz« – nyilatkozta. Figyelmeztetett, hogy az OpenAI által leírt típusú támadások már az »frontier research lab«-ok falain kívül elérhető technológiával is végrehajthatók.