DeepSeek zverejnil na platforme Hugging Face váhy modelu DeepSeek-V4-Flash-Vision-Exp — prvého experimentálneho multimodálneho modelu vo svojej rodine V4. Podľa oficiálnej dokumentácie model stavia na architektúre DeepSeek-V4-Flash, do ktorej pridal vizuálne moduly a prešiel ďalším tréningom zameraným na odomknutie schopnosti porozumieť obrazovému vstupu. Podľa DeepSeek model oproti predchádzajúcej verzii DeepSeek-V4-Flash-0731 dosahuje výrazné zlepšenie v multimodálnych agentických úlohách, pri zachovaní porovnateľného výkonu na čisto textových agentických úlohách.
Model prešiel dvojfázovým vydaním — na API platforme DeepSeek bol dostupný už od 21. augusta 2026, teda desať dní pred zverejnením samotných váh. Toto oneskorenie medzi API a otvorenými váhami dalo firme podľa pozorovateľov priestor zozbierať prevádzkovú telemetriu z reálnych multimodálnych záťaží ešte predtým, než checkpoint natrvalo zverejnila. Podľa metadát na Hugging Face má model 305 miliárd parametrov (samotný DeepSeek pri jadre architektúry MoE — zmesi expertov — uvádza 284 miliárd, rozdiel pripadá na vizuálnu vežu, zarovnávací modul a pomocné komponenty). Repozitár obsahuje minimálnu referenčnú implementáciu v PyTorch, ktorá podľa slov DeepSeek "pokrýva vizuálny kóder a zarovnávač, DFlash pozornosť, MoE, Hyper-Connections a DSpark postup dopredu", spolu s návodmi na nasadenie cez nástroje vLLM a SGLang. Model je publikovaný celý v presnosti FP8.
Vydanie prichádza len týždeň po tom, čo iné čínske laboratórium, Z.ai, 25. augusta zverejnilo na Hugging Face vlastný otvorený multimodálny model podobnej veľkosti — GLM-5.3-Flash. Ide tak podľa Tech Times o prvý týždeň, počas ktorého dve čínske laboratóriá súčasne ponúkli multimodálne MoE modely nad 300 miliárd parametrov pod licenciou MIT s otvorenými váhami.
Pri hodnotení vlastných benchmarkov DeepSeek tvrdí, že model uzatvára väčšinu rozdielu v multimodálnych agentických úlohách voči modelu Claude Opus 4.8 od Anthropic, pri zachovaní textového výkonu. Podľa nezávislej analýzy Tech Times model vyhráva tri z jedenástich sledovaných benchmarkov oproti Opus 4.8 — ide však výhradne o čísla z vlastného meracieho rámca DeepSeek (DeepSeek Harness), ktoré k dátumu zverejnenia žiadne nezávislé laboratórium ešte nezopakovalo ani nepotvrdilo. Presné porovnania s konkrétnymi uzavretými modelmi je preto potrebné brať s určitou rezervou, kým sa neobjavia nezávislé benchmarky.
Model podporuje kontextové okno 1 048 576 tokenov a maximálnu dĺžku odpovede 384-tisíc tokenov, s predvolene zapnutým režimom "premýšľania" (thinking mode). Prijíma text a obrázky, vracia text, a je dostupný cez OpenAI-kompatibilné aj Anthropic-formátové rozhrania API. Cena zostáva na úrovni bežného modelu V4-Flash — 0,14 dolára za milión vstupných tokenov (pri zásahu do medzipamäte len 0,0028 dolára) a 0,28 dolára za milión výstupných tokenov, pričom samotné obrázky sa pri fakturácii počítajú maximálne ako 384 tokenov každý, bez osobitného poplatku za obrázok.
Model nadväzuje na širšiu rodinu DeepSeek V4, ktorá prvýkrát vyšla pod licenciou MIT 22. apríla 2026 a odvtedy prešla viacerými aktualizáciami — aktuálne produkčné checkpointy zahŕňajú DeepSeek-V4-Flash-0731 (167 GB vo FP8, 43 vrstiev, 256 expertov s 6 aktívnymi) a väčší DeepSeek-V4-Pro-0813 (893 GB vo FP8), oba s miliónovým kontextovým oknom.
Vydanie zapadá do dlhodobej stratégie DeepSeek udržiavať svoje modely voľne dostupné pod permisívnou licenciou MIT, ktorá umožňuje širokú komerčnú aj nekomerčnú úpravu a redistribúciu — na rozdiel od mnohých uzavretých západných konkurentov. Vzhľadom na veľkosť modelu (305 miliárd parametrov vo FP8) však jeho lokálne nasadenie vyžaduje výkonnú viac-GPU infraštruktúru, čo prakticky obmedzuje okruh vývojárov a firiem, ktorí ho dokážu reálne sami hostovať, aj napriek voľnej dostupnosti samotných váh.
