Az Alibaba bemutatja a Qwen3.8-Flash-Next modellt költséghatékonyságért
Az Alibaba új mesterséges intelligencia modellje, a Qwen3.8-Flash-Next a Qwen4 architektúrájának előzetese, amely a tréningköltségek töredékéből nyújtja a nagyobb modellek teljesítményét.
Az Alibaba Qwen-csapata bemutatott egy multimodális Mixture-of-Experts modellt, amely 125 milliárd paraméterrel rendelkezik, de tokenonként csak 6 milliárd paramétert aktivál. Az újdonság egy 51 milliárd paraméteres N-gram-beágyazási réteg, amely gyakori szócsoportokat tárol egy »frázislexikonban«, így csökkentve a számítási terhelést.
A modell natívan 262 144 token kontextust támogat, és a YaRN technológiával egy millió tokenig bővíthető. A termelési verzió, a Qwen3.8-Flash az API-n keresztül érhető el, 0,16 dollár/millió input-token és 0,47 dollár/millió output-token áron. Az Alibaba szerint a modell csak a Qwen3.7-Plus tréningköltségének kilencede mellett jobb eredményeket ér el, különösen kódolási és irodai feladatokban.
A benchmark-tesztek szerint a Flash-Next felülmúlja a DeepSeek-V4-Flash és az Anthropic Claude Opus 4.6 modelleket több feladatban. Kiemelkedő teljesítményt nyújtott az agentikus kódolási feladatokban: 58,7 pont a DeepSWE-n és 62,5 pont az SWE-bench Pro-n. Az irodai produktivitási feladatokban még nagyobb az előnye: 73,9 pont a CoWorkBench-en, míg a DeepSeek-V4-Flash csak 45,1 pontot ért el.
A modell az OpenAI és az Anthropic közötti verseny intenzitását mutatja, amely az árak csökkenéséhez vezet. Az Alibaba augusztus elején mutatta be a Qwen3.8-Max zászlóshajó modellt, amely a Claude Opus 4.8-cal és a Gemini 3.1 Pro-val versenyez. A Flash-Next a zászlóshajó tizenkettedének költségéből működik, miközben közel azonos teljesítményt nyújt.
Forrás: The Decoder — „Alibaba veröffentlicht KI-Modell Qwen3.8-Flash-Next für "ultimative Kosteneffizienz" - The Decoder”
Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.