← Späť Píše AI. Človek kontroluje.
ai tím Novinko

Čínsky DeepSeek predstavil nový AI model, ktorý sa vyrovná americkej špičke za zlomok nákladov

Foto: AI ilustrácia
Čínska firma DeepSeek uvoľnila nový jazykový model DeepSeek-V4.1-Flash, ktorý si podľa vlastných testov v časti úloh vedie porovnateľne s najvýkonnejšími americkými modelmi — pri výrazne nižších prevádzkových nákladoch. Model je navyše voľne dostupný pod otvorenou licenciou.

DeepSeek, čínska AI firma, ktorá koncom roka 2024 prekvapila svet lacným, no výkonným modelom a poslala akcie amerických technologických firiem prudko nadol, tento týždeň predstavila svoj najnovší model DeepSeek-V4.1-Flash. Ide o model s 552 miliardami parametrov, ktorý však pri každej jednotlivej odpovedi reálne "zapája" len malý zlomok z nich — 8 miliárd pri spracovaní vstupu a 16 miliárd pri generovaní výstupu. Práve tento prístup, keď model nemusí pri každej úlohe využívať celú svoju kapacitu, je kľúčovým dôvodom, prečo je prevádzka podstatne lacnejšia než by zodpovedalo jeho celkovej veľkosti.

Druhou veľkou novinkou je spôsob, akým si model "pamätá" dlhší kontext počas rozhovoru — teda ako dlho dokáže sledovať a nadväzovať na predchádzajúci text v jednej konverzácii. DeepSeek tvrdí, že pamäťová stopa potrebná na udržanie kontextu až do jedného milióna slov (zhruba 1500 strán textu) sa mu podarilo znížiť približne štvornásobne oproti predchádzajúcej verzii a viac než 400-násobne oproti svojmu úplne prvému modelu. V praxi to znamená, že prevádzka takéhoto výkonného modelu si vyžaduje výrazne menej drahej pamäte a úložiska, čo priamo znižuje náklady na jeho beh vo veľkom meradle.

Podľa vlastných testov DeepSeeku si nový model v niektorých agentných úlohách — teda pri samostatnom plnení zložitejších, viackrokových zadaní ako je programovanie či práca s príkazovým riadkom — vedie porovnateľne, miestami dokonca lepšie, než najvýkonnejší model konkurenčnej americkej firmy Anthropic s označením Opus 5. Napríklad v teste Terminal-Bench 2.1 dosiahol DeepSeek skóre 90,6 oproti 89,1 u Opus 5. Treba však zdôrazniť, že ide o čísla, ktoré si DeepSeek zmeral a zverejnil sám — nejde o nezávisle overené porovnanie treťou stranou. Obraz navyše nie je jednoznačne v prospech DeepSeeku: v náročnejšom teste Terminal-Bench 4.0, zameranom na expertné vedecké úlohy, dosiahol DeepSeek len 31,2 bodu oproti 51,8 u Opus 5 — teda v tejto konkrétnej oblasti zostáva rozdiel v prospech amerického modelu výrazný.

Model je zároveň zverejnený pod takzvanou MIT licenciou — jednou z najotvorenejších licencií v softvérovom svete, ktorá umožňuje komukoľvek model voľne stiahnuť, upravovať a používať aj komerčne, bez nutnosti platiť DeepSeeku licenčné poplatky.

Pre bežného čitateľa je táto správa súčasťou širšieho príbehu: preteky medzi americkými a čínskymi AI firmami už nie sú len o tom, kto má najvýkonnejší model, ale čoraz viac aj o tom, kto dokáže porovnateľný výkon ponúknuť za nižšiu cenu a voľnejšie podmienky použitia. Keďže DeepSeek svoje modely pravidelne zverejňuje ako otvorené, majú k nim priamy prístup vývojári, firmy aj výskumníci po celom svete — vrátane tých, ktorí by si drahšie uzavreté modely americkej konkurencie nemohli dovoliť.

← Všetky správy