Anthropic: Opus 5.5 szigorúbb biztonsági intézkedésekkel
Az Anthropic új csúcsmodellje, az Opus 5.5 40 százalékkal olcsóbb, mint elődje, és 85 százalékkal ritkábban próbálja megkerülni a biztonsági korlátokat. A cég külső tesztelőkkel ellenőrizteti a modellt, és szigorított biztonsági mechanizmusokat vezetett be.
Az Opus 5.5 az első csúcsmodell, amelyet az Anthropic vezetője, Dario Amodei és kollégái nyilvánosan az AI-fejlesztés lassítása mellett szólaltak meg. A modell a benchmarkokban megelőzi az OpenAI Fable 5.1-et, és 40 százalékkal alacsonyabb token-költséggel működik az Opus 5-höz képest. Az Anthropic az illesztés (alignment) terén jelentős javulást ért el: az Opus 5.5 85 százalékkal ritkábban kísérli meg a biztonsági határok megkerülését, mint az Opus 5 vagy a Mythos 5.1.
A biztonsági intézkedések között szerepel a külső felülvizsgálat: az Opus 5.5 az első modell, amelyet a kiadás előtt független tesztelők (például a Frontier Design és a Metr intézetek) ellenőriztek. A modell az Opus 4.8-hoz hasonló védelmi mechanizmusokat kapott a kritikus területeken, például a kiberbiztonsággal és biológiával kapcsolatos kérések blokkolásához.
Az Anthropic a jövőbeli fejlesztésekre is felkészül: szigorította a tanítási folyamatot, és fokozottabb monitorozást vezetett be a biztonsági tesztek során, beleértve a gondolatmenet nyomon követését. A modell különösen a kódolás, tudásintenzív feladatok és kommunikáció terén mutat előrehaladást. Az Opus 5.5 a Claude asszisztensben, valamint az AWS, Google Cloud és Microsoft Azure platformokon érhető el.
Forrás: ComputerBase — „KI-Tempo drosseln?: Was Anthropic beim neuen Top-Modell Opus 5.5 ändert - ComputerBase”
Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.