DeepSeek V4.1-Flash: drasztikusan csökkent memóriaigény
A DeepSeek új multimodális AI-modellje, a V4.1-Flash jelentősen csökkenti az AI-ágensek üzemeltetési költségeit azáltal, hogy a közbenső gyorsítótár méretét negyedére redukálja az elődhöz képest.
A DeepSeek V4.1-Flash 552 milliárd paramétert tartalmaz és egymillió token hosszúságú kontextusokat képes feldolgozni. A modell a gyorsítótárat (KV-cache) intelligens felosztással optimalizálja: a bemeneti adatok feldolgozásakor csak 8 milliárd paramétert aktivál, míg a szövegkimenetnél 16 milliárdot használ. Ez közel felére csökkenti a bemeneti adatok feldolgozásához szükséges számítási kapacitást, ami különösen az ágensek számára előnyös, amelyek gyakran hívnak meg eszközöket és új bemeneteket dolgoznak fel.
A memóriaoptimalizálás több technika kombinációjával valósul meg: a fő gyorsítótárat FP4 helyett FP8 formátumban tárolják, ami szintén felére csökkenti a memóriaigényt. Az előző V4-Flash modellhez képest a gyorsítótár a gyors videomemóriában negyedannyi helyet foglal, az SSD-n vagy a gazdagép memóriájában pedig nyolcadannyi helyet igényel. A V1-hez képest pedig a globális KV-cache mérete 437-szeresére csökkent tokononként.
A modellt 45 billió tokent tartalmazó adathalmazon tanítottak, amely szöveget és képeket egyaránt magában foglal. A DeepSeek hangsúlyozza, hogy a fejlesztések nem új algoritmusokból, hanem nagyobb és jobban kontrollált adatokból, feladatokból és tanítási környezetből erednek. A benchmark-teszteken a V4.1-Flash az OpenAI GPT-5.6 Sol és az Anthropic Opus 5 modellekhez hasonló teljesítményt nyújt a szoftverfejlesztési feladatokban (74,2 százalék), bár összetett tudományos ágensfeladatokban és képelemzésben még lemarad a vezető zárt rendszerekhez képest. A modell MIT-licenc alatt szabadon elérhető a Hugging Face platformon, és az API-n keresztül ugyanolyan áron érhető el, mint a V4-Flash.
Forrás: The Decoder — „Neues Deepseek-Modell V4.1-Flash senkt Speicherbedarf für KI-Agenten - The Decoder”
Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.