NoézisAI-hírek magyarul
Modellek · GoogleWatchBlog

Google bemutatja a Gemini 3.8 Live Avatar AI-modellt

A Google új mesterséges intelligencia-modellje, a Gemini 3.8 Live Avatar lehetővé teszi valósidejű interakciókat fotorealisztikus AI-avatárokkal, amelyek beszélnek, hallanak és látnak. Az eszköz a Gemini Enterprise szolgáltatáson keresztül érhető el üzleti felhasználók számára.

szept. 28.

A Gemini 3.8 Live Avatar a közelmúltban kiadott Gemini 3.8 Live modellre épül, és valósidejű videogenerálást kombinál beszédfelismeréssel. Az AI-generált avatar precíz lippeszinkronizációval, természetes arckifejezésekkel és folyamatos beszélgetésfolyammal rendelkezik. A rendszer vizuális és akusztikus bemeneteket egyidejűleg dolgoz fel, ami természetesebbé teszi az interakciót más avatárokhoz képest.

A Google szétválasztott rendszert alkalmaz, ahol a beszéd és a gondolkodás külön működik. Ez lehetővé teszi az avatárnak, hogy háttérben adatokat kérjen le vagy eszközöket aktiváljon anélkül, hogy a felhasználóval folytatott beszélgetést megzavarná – például virtuális szállodai bejelentkezéskor. Az avatar 97 nyelv között képes dinamikusan váltani, miközben a lippeszinkronizáció és a mimika automatikusan alkalmazkodik a videóminőség romlása nélkül.

A vállalatok választhatnak egy elődefiniált avatárkészletből, vagy egyéni avatárt hozhatnak létre referenciakép alapján, amely megfelel a márkaazonosságuknak. A Gemini 3.8 Live Avatar azonnal elérhető a Gemini Enterprise szolgáltatáson keresztül, és üzleti ügyfelek számára készült, hogy személyesebbé és hozzáférhetőbbé tegyék az ügyfélszolgálatot és az interaktív útmutatókat.

Forrás: GoogleWatchBlog — „Gemini 3.8 Live Avatar: Google veröffentlicht neues KI-Modell für interaktive Echtzeit-Avatare (Videos) - GoogleWatchBlog”

Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.

Még a modellek rovatból

Továbbiak →