NoézisMI-hírek magyarul
Modellek · slashCAM

FLUX 3: német AI-cég bemutatta első videógenerálási modelljét

A Black Forest Labs freiburgi mesterséges intelligencia-fejlesztő bemutatta FLUX 3 videógenerálási modelljét, amely szövegből, képekből vagy videókból készíthet akár 20 másodperces videóklipeket natív hanggal együtt.

A Black Forest Labs két évvel az eredeti FLUX képgenerálási modell után mutatta be első multimodális videómodelljét. A FLUX 3 720p felbontásban, legfeljebb 20 másodperces videóklipeket tud generálni szinkronizált hanggal, amely lehet zaj vagy beszéd is. A rendszer támogatja a szöveg-videó, kép-videó, videó-videó konverziót, valamint kulcsképek alapján vezérelt átmeneteket.

A modell képes különféle vizuális stílusok megjelenítésére, az autentikus kamerafelvételektől az animációkig és filmszerű megjelenítésig. Az ügynökalapú láncolás révén több klip összekapcsolható hosszabb szekvenciákban, így konzisztens karakterekkel rendelkező többperces rövidfilmek készíthetők. A demók szerint a FLUX 3 jól kezeli a folyadékok viselkedését, az állatok mozgását és a kameraműködéseket, azonban az emberi arcok és mozgások közeli felvételei még hiányoznak.

A Black Forest Labs saját összehasonlítási tesztje szerint a FLUX 3 versenyképes a Google Omni Flash és a Seedance 2.0 csúcsmodellekkel. A FLUX 3 Video gated early access-hez már elérhető, a FLUX 3 Image pedig a következő hetekben érkezik. Az open-weight FLUX 3 Dev verzió 2026 későbbi részére van ütemezve.

A cég emellett a mimic robotics-szal közösen fejlesztette a FLUX-mimic modellt, amely robotikai greifer-manipulációra specializálódott és már az Audi termelésében tesztelésre kerül. A FLUX 3 Action variáns és a FLUX-mimic jelenleg kiválasztott kutatási és ipari partnerek számára érhető el.

Forrás: slashCAM