GLM-5.3: kibernetikai fenyegetés gyenge védelemmel
Az Anthropic kutatói szerint a Zhipu AI GLM-5.3 modellje képes autonóm módon kifinomult kibernetikai exploitokat fejleszteni, és lényegesen gyengébb védelemmel rendelkezik, mint a versenytárs amerikai modellek.
Az Anthropic elemzése szerint a GLM-5.3 hasonló képességeket mutat az autonóm exploit-fejlesztésben, mint a Claude Mythos Preview modell. Az ExploitBench teszten a GLM-5.3 410 kísérletből 50 végpontok közötti exploitot fejlesztett ki, míg a Claude Mythos Preview 56-ot. Az Anthropic saját Binary Exploitation benchmarkján a GLM-5.3 az esetek 4 százalékában érte el a teljes vezérlésfolyam-eltérítést, szemben a Claude Mythos Preview 6 százalékával. Az Anthropic szerint a GLM-5.3 az eddig kiadott legkibernetikai-képesebb nyílt súlyú modell.
A kritikus különbség a védelemben rejlik: az Anthropic szimulált teszteiben az támadók a GLM-5.3 védelmi mechanizmusait 64 és 100 százalék közötti arányban tudták megkerülni egyszerű technikákkal, míg a védett Claude-modellek ellen ezek a támadások nem voltak sikeresek. A NIST Mesterséges Intelligencia Szabványok és Innovációs Központja szeptember 17-én közzétett saját értékelésében szintén a GLM-5.3-at nevezte az eddig kiadott legkibernetikai-képesebb nyílt súlyú modellnek, amely körülbelül négy hónappal marad el az amerikai frontier szintjétől.
Az Anthropic kutatói egy gyakorlati kísérletben azt tapasztalták, hogy a GLM-5.3 egy nap alatt több korábban ismeretlen sebezhetőséget talált egy népszerű webböngésző JavaScript-motorjában, és ezeket egy működő exploitba láncolta össze – egy olyan weboldalt, amely a meglátogatásakor tetszőleges fájlokat olvashat ki a látogató számítógépéről. A kutatók a sebezhetőségeket a karbantartónak jelentették.
Forrás: Anthropic — „GLM-5.3 and the spread of advanced cyber capabilities - Anthropic”
Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.