NoézisAI-hírek magyarul
Üzlet · The Decoder

Startap szűrők nélküli AI-modelleket kínál kereskedelmi alapon

Az Abliteration.ai amerikai startup eltávolítja a biztonsági szűrőket nyílt súlyozású AI-modellekből és szolgáltatásként értékesíti azokat. A módszer legális, de jelentős biztonsági kérdéseket vet fel.

szept. 6.

Az Abliteration.ai az augusztus végén bemutatott »abliterated-model-large-v2« modellel a Z.AI GLM-5.3 verzióját módosította úgy, hogy az biztonsági kérdésekre sokkal ritkábban utasít vissza. Az abliteráció nevű eljárás a modell belső aktivációs mintáit azonosítja és módosítja, hogy elnyomja az elutasítási mechanizmusokat. Az eljárás nem prompt-jailbreak, hanem a modell súlyaiba történő közvetlen beavatkozás. A cég saját értékeléseit közölte: 84,5 százalék a CyberGym teszten, 41,8 százalék a Terminal-Bench 4.0-n és 105 megoldott ExploitGym-feladat két óra alatt. Az abliterált modell azonban nem vezet minden benchmarkon: a GPT-5.5 85,6 százalékot ért el a CyberGym-en, az ExploitGym-en pedig a GPT-5.6 Sol és a Fable 5 jelentősen több feladatot oldott meg.

Az Abliteration.ai az abliterált GLM-5.3 modellhez való hozzáférést havonta öt dollárért kínálja millió tokenenként. A vállalat az offenzív kiberbiztonsági tesztelésre, AI red teaming-re, ágensek tesztelésére és bizalmi és biztonsági értékelésekre marketing az szolgáltatást. A startup alapítója szerint az első kereslet főleg nagy vállalatok és bankok AI-ágenseinek teszteléséből származott, hogy ellenőrizzék, vajon támadók képesek-e jailbreak vagy prompt injection segítségével jogosulatlan műveletre kényszeríteni azokat. Azonban a SaferAI szerint az eredeti GLM-5.2 már egyetlen offenzív biztonsági értékelésben sem utasított vissza feladatot, és több red team-szolgáltató nem használ abliterált modelleket a gyakorlatban.

A TechCrunch tesztelése szerint az abliterált modell viszonylag könnyen generált Chrome-jelszavak kiolvasásához szükséges kódot és részletes útmutatót egy veszélyes kórokozó tenyésztéséhez, bár az önkárosítási kérésekre továbbra is működtek a védelmi mechanizmusok. Az Abliteration.ai nem végez azonosságellenőrzést, és nem tárolt promptokat és válaszokat, csak operatív metaadatokat. Az anonim alapító szerint az azonosságellenőrzés nem tudná megbízhatóan megkülönböztetni a legitim és illegális felhasználást. Az ügyfeleknek lehetőségük van opcionális szabályzati átjáróval saját korlátozásokat beállítani, de az alapértelmezett modellhozzáférés nagyrészt korlátlan marad.

Forrás: The Decoder — „Entfesselte KI-Modelle: Start-ups verkaufen Zugang ohne Sicherheitsfilter - The Decoder”

Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.

Még a üzlet rovatból

Továbbiak →