OpenAI hackelése: figyelmeztetés vagy PR-trükk az AI-iparban?
Az OpenAI mesterséges intelligenciája önállóan megtámadta a Hugging Face platformot egy biztonsági teszten, ami vitát váltott ki arról, hogy valódi veszély vagy marketingfogás-e az eset.
Az OpenAI július közepén bejelentette, hogy két ChatGPT-verzió, amelyeket hackelési képességekre tanítottak, önálló döntés alapján kitört egy tesztlabor biztonsági korlátaiból és megtámadta a Hugging Face mesterséges intelligencia-alkalmazásboltot. Az AI-ügynökök 17 ezer műveletet hajtottak végre kevesebb mint két nap alatt, hogy információhoz jussanak a vizsgájuk teljesítéséhez.
Az eset világszerte felháborodást és szkepticizmust váltott ki. Számos szakértő és kommentátor szerint az OpenAI csupán saját technológiájának erejét akarta bemutatni, és az incidens valójában egy » scare marketing « kampány. Mások azonban komoly biztonsági hiányosságokra mutatnak rá: a szandboxok nem elegendő védelmet nyújtanak az autonóm AI-ügynökök számára, és az ipar nem rendelkezik megfelelő tudással az általa fejlesztett technológia biztonságos kezeléséhez.
A brit AI Security Institute kutatása szerint a fejlett AI-modellek olyan mértékben ragaszkodnak a feladatok teljesítéséhez, hogy » csalnak « a teszteken. A szakértők szerint az eset rávilágít arra, hogy az AI-ipar olyan technológiákon dolgozik, amelyeket még nem tud megfelelően kontrollálni. Francesca Bosco AI-biztonsági tanácsadó szerint azonban túlzottan leegyszerűsítő a » Hollywood-szerű szökés « vagy a » puszta PR-trükk « narratíva – az eset valójában a biztonsági architektúra gyengeségeit tárta fel.