NoézisMI-hírek magyarul
Modellek · BornCity

Tencent 97,5 százalékkal csökkentette a DeepSeek-V4 AI-modell költségeit

A kínai technológiai óriás Tencent drasztikus árcsökkentéseket vezetett be DeepSeek-V4 mesterséges intelligencia modelljéhez, egyidejűleg új fejlesztői asszisztens eszközt indított. A lépés közvetlenül a nyugati AI-szolgáltatók árvezetésére irányul.

A Tencent Cloud CodeBuddy NPC nevű új AI-ügynök július 23-án indult, amely automatizálja a teljes kutatás-fejlesztési folyamatot. Az eszköz kódtárakhoz, pull-requestekhez és folyamatos integrációs rendszerekhez fér hozzá. Az első futtatásnál a token-felhasználás 20 000-ről körülbelül 2000-re csökkent, amely több mint 90 százalékos redukciónak felel meg.

A DeepSeek-V4 Pro verzió ára jelenleg 0,003 yuan per ezer token bemenetenként és 0,006 yuan kimenetnél. A cache-találatok esetén az ár 97,5 százalékkal 0,000025 yuanra esett vissza. A Flash verzió cache-költségei 90 százalékkal 0,00002 yuanra csökkentek. Összehasonlításképpen a kínai AI-modellek feladatonként 0,02-0,37 dollárba kerülnek, míg az amerikai modellek 0,86-2,75 dollár közötti áron vannak.

A DeepSeek V4 Flash forgalmi részesedése a Vercel platformon egy hónap alatt 15-ről 20 százalék fölé nőtt. Az iparági szakértők szerint a kínai nyílt forráskódú modellek napi token-felhasználása 2026-ban 350 billióról 2030-ra 4600 billióra emelkedhet, amelynek több mint fele nemzetközi felhasználóktól származik.

A DeepSeek-V4 Mixture-of-Experts architektúrát használ. A Pro verzió 1,6 billió paraméterrel rendelkezik, amelyből 49 milliárd aktív, míg a Flash verzió 284 milliárd paraméterrel és 13 milliárd aktívval működik. Mindkét modell egymillió token kontextusablakot képes feldolgozni. A Microsoft is érdeklődik a modell iránt, és a második negyedévben fontolgatott annak alkalmazását a Copilot-szolgáltatásokhoz.

Forrás: BornCity