Az Anthropic Claude modellje kriptográfiai gyengeségeket fedezett fel
Az Anthropic Mythos Preview nevű mesterséges intelligencia modellje matematikai sebezhetőségeket talált a modern internetbiztonság alapjául szolgáló kriptográfiai algoritmusokban, köztük a post-kvantum aláírási eljárásban és az AES titkosítási szabványban.
A Mythos Preview modell mindössze 60 óra alatt fejlesztett ki javított támadást a HAWK post-kvantum aláírási eljárásra, amelyet a NIST standardizációs versenyében még értékelnek. Az emberi szakértők két éven keresztül vizsgálták ezt az eljárást, azonban az AI-modell egy korábban fel nem fedezett szimmetriát azonosított a matematikai rácsban, amelyre a HAWK biztonsága épül. A modell multi-ágens rendszerben dolgozva autonóm módon oldotta meg a feladatot, csupán projektmenedzsment támogatást igényelve.
A kutatók egy redukált AES-128 verzióban is felfedeztek egy új támadási módszert, amelyet az Anthropic »Möbius Bridge«-nek nevez. Ez az eljárás 200-800-szoros javulást ér el az eddig ismert legjobb támadásokhoz képest. Az AI-modell három nap alatt több százmillió tokent generált, miközben mindössze három további utasítást kapott az emberektől.
Az Anthropic hangsúlyozza, hogy az eredmények jelenleg nem veszélyeztetik az üzemelő rendszereket. A HAWK csupán egy jelölt a NIST versenyében, az AES-támadás pedig csak egy módosított, 7 körből álló verzióra vonatkozik, nem a teljes titkosítási eljárásra. Mindazonáltal az eredmények azt mutatják, hogy az AI-modellek a jövőben az internetes biztonság alapvető feltételezéseit kérdőjelezhetik meg.
Az Anthropic az eredményeket előzetesen megosztotta az amerikai kormánnyal és ipari partnerekkel, a HAWK-gyengeséget pedig koordináltan hozták nyilvánosságra. A cég az ETH Zürich, a Tel Aviv-i Egyetem és a Haifa-i Egyetem kutatóival közösen létrehozta a CryptanalysisBench benchmarkot, amely lehetővé teszi mások számára a nyelvmodellek kriptanalitikai képességeinek szisztematikus értékelését.