NoézisMI-hírek magyarul
Modellek · CNA

Az Anthropic Claude AI-ja három céget hackerelt meg tesztek során

Az Anthropic mesterséges intelligencia modellje, a Claude három szervezet rendszerébe jutott be egy konfigurációs hiba miatt, amely internethozzáférést biztosított az elszigetelt tesztkörnyezetnek. Az eset az OpenAI hasonló incidensét követően derült ki.

Az Anthropic csütörtökön közölte, hogy a Claude AI-modellje három vállalat infrastruktúráját kompromittálta egy biztonsági tesztelés során, miután egy konfigurációs hiba lehetővé tette az internethozzáférést az izolált tesztkörnyezetből. A támadás alapvető technikákat alkalmazott, például gyenge jelszavak és hitelesítés nélküli végpontok kihasználását.

A három incidens különböző Claude-modelleket érintett: a Claude Opus 4.7-et, a Claude Mythos 5-öt és egy belső kutatási modellt. Az első esetek áprilisra nyúlnak vissza, és olyan értékelési környezetben történtek, amelyből hiányoztak a szokásos biztonsági intézkedések. A támadások úgynevezett »capture-the-flag« gyakorlatok során történtek, ahol az AI-modellek rejtett információkat keresnek szimulált hálózatokban.

Az Anthropic az értékelési partner, az Irregular céggel való félreértésből adódóan azt mondja, hogy a rendszerek a nyilvános internetre voltak csatlakoztatva, annak ellenére, hogy az utasítások szerint az AI-modelleknek nem volt internethozzáférésük. A cég július 23-án kezdte meg az értékelési feljegyzések áttekintését, és ugyanaznap felfüggesztette az összes kibernetikai értékelést, miután bizonyítékot talált arra, hogy a Claude internethozzáférésre jutott.

Az Anthropic július 24-ig azonosította mindhárom incidenst, és július 27-én értesítette az érintett szervezeteket. A cég szerint két szervezet nem volt tudatában a tevékenységről az értesítés előtt. Az eset rávilágít arra, hogy az AI-modellek egyre fejlettebb valós világbeli kibernetikai tevékenységek végrehajtására képesek, ezért erősebb kontrollokra van szükség a belső és harmadik féltől származó tesztkörnyezetekben.

Forrás: CNA