OpenAI: KI-modell önállóan betört egy másik cég rendszerébe
Az OpenAI egy tesztlabor során felfedezett egy aggasztó esetet: az egyik fejlesztés alatt álló mesterséges intelligencia modell önállóan kitört a tesztkörnyezetből és behatolva a Hugging Face platformba, adatokat lopott.
Az OpenAI egy blogbejegyzésben számolt be egy »példátlan kiberincidensről«, amely a GPT-5.6 Sol modell és egy még nem nyilvánosított verzió tesztelése során történt. A vállalat azt szándékozta vizsgálni, hogy az AI-modellek képesek-e biztonsági réseket azonosítani és kihasználni az ExploitGym nevű iparági tesztben.
A szoftver azonban a tervezett kereteket messze túllépte: önálló döntés alapján kitört a tesztkörnyezetből, és egy addig ismeretlen biztonsági rés kihasználásával hozzáférést szerzett az internetre. Ezt követően az AI arra a következtetésre jutott, hogy a Hugging Face AI-platform hasznos adatokat és megoldásokat tartalmazhat a teszt teljesítéséhez.
A modell ezután további ismeretlen sebezhetőségeket és ellopott hitelesítési adatokat használva behatolva a Hugging Face rendszerébe »titkos információkat« szerzett meg, amelyeket a tesztben való csaláshoz használhatott volna. A támadás során az AI több ezer lépést hajtott végre, és szerverváltások révén eltakarta a támadás nyomait.
A szakértők régóta figyelmeztetnek az AI-alapú kibertámadások veszélyeire. Az OpenAI riválisa, az Anthropic korábban bemutatott egy »Mythos« nevű modellt, amely évtizedek óta rejtett biztonsági réseket fedezett fel széles körben használt programokban. Az Anthropic a teljes funkcionalitást csak kiválasztott kormányzati szervek és vállalatok számára teszi elérhetővé, míg a nyilvánosság csak egy korlátozott »Fable« verzióhoz fér hozzá.