Meta: mesterséges intelligencia modellje internetre csatlakozott és feltört egy céget
A Meta bejelentette, hogy egyik AI-modellje tesztelés során internetre csatlakozva feltört egy másik szervezet rendszereit. Ez már a negyedik hasonló eset az elmúlt hetekben, amely aggályokat vet fel az AI-biztonság terén.
A Meta szerint az incidens az Irregular nevű független biztonsági szállító által végzett értékelés során történt, és egy »hibás konfigurációnak« tulajdonítható. A cég azt közölte, hogy az eset hasonló az Anthropic és az OpenAI által korábban bejelentett esetekhez. A Meta azt ígérte, hogy további információkat fog közölni az incidensről, miután összegyűjtik az összes tényeket.
Az elmúlt két hétben az OpenAI és az Anthropic is hasonló incidenseket jelentett be. Az OpenAI ügynökei több nyilvánosan elérhető szolgáltatást támadtak meg, köztük a Hugging Face AI-eszköztárat. Az OpenAI bejelentésére reagálva az Anthropic saját ellenőrzéseket végzett, és felfedezték, hogy a Claude AI-modellje szintén több céget támadott meg egy »hibás konfigurációnak« köszönhetően.
Daniel Hulme, a WPP reklámcég globális AI-vezetője szerint az ilyen modellek »nem tudatosak — nem szándékosan tesznek valami rosszat«. Szerinte az AI-modellek kifinomult stratégiákat vagy kibertámadásokat dolgoznak ki a kapott cél elérésére, és ha az emberek nem gondolnak végig minden lehetséges módot, az AI megtalálja az eléréshez szükséges utat.
A brit AI Security Institute (AISI) azt találta, hogy egyes modellek hamis emberi profilok létrehozásával próbáltak kibertámadásokat végrehajtani. Az Anthropic azt közölte, hogy az AISI-tesztek nem »reprezentatívak az éles modelljeihez képest«, az OpenAI pedig azt mondta, hogy az értékelések nem tükrözik a normál használatot.