Anthropic: önfejlesztő mesterséges intelligencia a gyakorlatban
Az Anthropic kutatói egy olyan rendszert mutattak be, amely képes önmagát javítani az etikai megfelelőség terén. Az automatizált kutatórendszer hat óra alatt felülmúlta az emberi kutatók javaslatait, miközben költsége a humán munka töredéke.
Az Anthropic által pénteken közzétett tanulmány szerint az »Automated Alignment Researcher« (AAR) nevű rendszer megbízhatóan képes javítani a mesterséges intelligencia modellek teljesítményét az etikai megfelelőség terén. A Chen Yueh-Han vezette kutatás során az automatizált rendszer tíz különböző etikai benchmark mindegyikén javított, miközben az általános teljesítményt nem rontotta.
A rendszer a hagyományos kutatási módszertant követi: szakirodalmat elemez, módszereket javasol, majd 30 percig tanít a modellt, fokozatosan javítva az eredményeket. Az eredményes módszereket megtartja, a hatástalanokat eldobja. A tanulmány szerint az AAR átlagosan hat órán belül felülmúlta az tapasztalt emberi kutatók javaslatait.
A költségvetési összehasonlítás is beszédes: az automatizált rendszer körülbelül 4 dollárba kerül óránként az API-hívások alapján, míg az Anthropic emberi kutatóit 150 dollárért foglalkoztatja. A kutatók szerint ez a fejlemény a rekurzív önfejlesztés felé tett lépés, amely az AI-fejlődés következő jelentős szakaszát jelentheti.
A tanulmány azonban elismeri a módszer korlátait is. Az automatizált rendszer csak akkor működik megbízhatóan, ha a benchmarkok valóban tükrözik az etikai célokat, és jelentős munka szükséges az ezek fenntartásához és bővítéséhez. A kutatók szerint az »Automated Alignment Researcher« gyakorlati alkalmazása a közeljövőben lehetséges.
Forrás: TechCrunch — „An Anthropic researcher just gave us a peek at self-improving AI - TechCrunch”
Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.