Google bemutatja a Gemini 3.8 Live modelleket
A Google két új AI-modellt indított: a Gemini 3.8 Live-ot és a Gemini 3.8 Live Extended Thinking-ot, amelyek valós idejű beszéddialoggal és fejlett gondolkodási képességekkel rendelkeznek.
A Gemini 3.8 Live hatékonyságra és skálázhatóságra optimalizált modell, amely vizuális tartalmakat közel valós időben dolgoz fel és 97 nyelv között képes automatikusan váltani a beszélgetés közben. Az eszközöket és API-hívásokat a rendszer a háttérben végzi, anélkül hogy a beszédfolyamot megzavarná, így az AI közvetlenül megerősítheti a kéréseket és folytathatja a beszélgetést, miközben a tényleges feladat a háttérben fut.
A Gemini 3.8 Live Extended Thinking összetettebb feladatokhoz készült, és egyidejűleg képes gondolkodni és beszélni. Többlépcsős munkafolyamatok során a rendszer rövid verbális megjegyzésekkel áthidalja a számítási időket, és élőben kommentálja az előrehaladást. A Google az összes generált hangkimenetet saját SynthID-vízjellel látja el, hogy az AI által generált audiómaterial később is egyértelműen azonosítható legyen.
A bevezetés azonnal megkezdődött. A fejlesztők mindkét modellt a Gemini API-n és a Google AI Studio-n keresztül érhetik el, a vállalati ügyfelek pedig a Gemini Enterprise verzióban. A szokásos felhasználók a Gemini 3.8 Live-ot a Search Live-ban, a Gemini 3.8 Live Extended Thinking-ot pedig a Gemini Live-ban és a Google AI előfizetőinek a Workspace-alkalmazásokban (Docs, Gmail, Notesz) találják meg.
Forrás: Caschys Blog — „Google Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking starten - Caschys Blog”
Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.