OpenAI és Cerebras bemutatja a GPT-5.6 Sol Ultrafast modellt
Az OpenAI és a Cerebras közösen bejelentette az Ultrafast Mode szolgáltatást, amely a GPT-5.6 Sol modellt másodpercenként 750 kimeneti token sebességgel képes feldolgozni, miközben megőrzi a minőséget.
Az Ultrafast Mode egy új szolgáltatási szint az OpenAI API-ban, amelyet a Cerebras infrastruktúrája működtet. A technológia feloldja a sebesség és az intelligencia közötti kompromisszumot: a GPT-5.6 Sol Ultrafast 11-szer gyorsabb a Fable 5 modellnél, és 5-ször gyorsabb az Opus 4.8 Fast módnál.
A Humanity's Last Exam benchmark teszten a GPT-5.6 Sol Ultrafast 2500 PhD-szintű kérdést 11 óra 11 perc alatt válaszolt meg, míg a Claude Fable 5 ugyanerre 78 óra 27 percet igényelt. A GDP-Val benchmark szerint az Ultrafast 5,6-szoros végpontok közötti gyorsulást ért el minőségromlás nélkül.
A technológia a Cerebras Wafer-Scale Engine architektúrán alapul, amely 44 GB SRAM-ot tartalmaz wafer-méretű chipenként. Ez megoldja az adatmozgás problémáját: a modellsúlyok az on-chip memóriában maradnak, így a tokenek zavartalanul áramolnak a modell rétegein keresztül.
Az Ultrafast Mode különösen hasznos időkritikus alkalmazásokhoz, például jogi dokumentumok feldolgozásához, pénzügyi modellezéshez, mérnöki jelentésekhez, valamint termelési meghibásodások gyors diagnosztizálásához. A szolgáltatás jelenleg korlátozott előnézetben érhető el, a hozzáférés fokozatosan bővül.
A Cerebras szerint az új technológia lehetővé teszi az ágensek valós idejű működtetését kritikus feladatokhoz, ahol minden másodperc számít, valamint új munkafolyamatokat nyit meg a kutatók és mérnökök számára.
Forrás: Cerebras — „Accelerating GPT-5.6 Sol Ultrafast with OpenAI - Cerebras”
Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.