← Späť Píše AI. Človek kontroluje.
ai tím Novinko

Google predstavil Gemini 3.8 Flash a jeho kybernetickú verziu, v testoch prekonáva Claude Opus 5 aj GPT-5.6 Sol

Foto: AI ilustrácia
Google DeepMind v stredu 2. septembra vydal Gemini 3.8 Flash — svoj tretí Flash model za šesť týždňov — spolu so špecializovanou bezpečnostnou verziou 3.8 Flash Cyber určenou na vyhľadávanie zraniteľností. Podľa vlastných testov Google nový model na deviatich z 16 benchmarkov prekonáva konkurenčné modely Claude Opus 5 aj GPT-5.6 Sol.

Google DeepMind v stredu 2. septembra 2026 vydal Gemini 3.8 Flash, svoj najinteligentnejší model z rady Flash určenej na kódovanie, agentické úlohy a viacstupňové uvažovanie. Súbežne firma predstavila aj Gemini 3.8 Flash Cyber, špecializovanú verziu zameranú na vyhľadávanie softvérových zraniteľností a automatizované opravy (patching), dostupnú zatiaľ len cez novo spustený program Fairwind pre vlády a overených partnerov. Oznámenie podpísali Tulsee Doshi, senior riaditeľka produktového manažmentu, a Raluca Ada Popa, vedúca bezpečnosti Gemini v Google DeepMind.

Ide už o tretie vydanie z rady Flash za šesť týždňov — po modeli 3.6 Flash (21. júla) a 3.7 Flash (13. augusta) nasledoval 3.8 Flash presne tri týždne od predchodcu. Podľa vlastného vyhlásenia Google prezentuje model ako "náš doteraz najlepší model na uvažovanie a kódovanie, pri rovnakej rýchlosti a nízkej cene ako 3.7". Model je dostupný okamžite cez Gemini API, Google AI Studio, Android Studio, Antigravity, Gemini Enterprise aj priamo v aplikácii Gemini, pod označením gemini-3.8-flash.

Čo ukazujú benchmarky

Podľa vlastného testovania Google model absolvoval 16 AI benchmarkov a na deviatich z nich prekonal konkurenčné modely Claude Opus 5 aj GPT-5.6 Sol. Konkrétne čísla, ktoré sa podarilo overiť naprieč viacerými nezávislými zdrojmi:

Na teste Terminal-Bench 2.1 (viacstupňové kódovacie úlohy) dosiahol Gemini 3.8 Flash 90,8 %, čo je nárast z 81,6 % u 3.7 Flash. Na benchmarku DeepSWE v1.1, ktorý meria zvládanie dlhodobejších softvérových inžinierskych úloh, model podľa Google prekonáva väčšinu väčších frontier modelov konkurencie, a to pri zlomku prevádzkových nákladov. Na teste HLE-Verified (Humanity's Last Exam, viacstupňové uvažovanie naprieč prírodnými aj humanitnými vedami) dosiahol model 54,9 % — v porovnaní s pôvodným, ešte neverifikovaným testom Humanity's Last Exam zostal výsledok prakticky nezmenený (45,4 % oproti 45,7 % u predchodcu), teda zlepšenia sú podľa dostupných dát nerovnomerné a sústredené najmä na kódovanie a prácu s nástrojmi (tool use).

V priamom porovnaní s Claude Opus 5 model Gemini 3.8 Flash podľa portálu Proje Defteri (kompilácia dát z Google a Artificial Analysis) víťazí vo financiách (61,4 %), práve (10,0 %), teste HLE-Verified (54,9 %), spracovaní dlhého videa (87,8 %) a interpretácii grafov (86,2 %). Naopak prehráva na Terminal-Bench 4.0 (19,1 % oproti 51,8 % u Opus 5) a na teste OSWorld-2.0. Nezávislé meranie rýchlosti od Artificial Analysis umiestnilo model na 3. mieste zo 196 testovaných modelov v kategórii rýchlosti výstupu.

Zaujímavým detailom, ktorý Google priamo uvádza vo vlastnej dokumentácii, je fakt, že Gemini 3.8 Flash nie je postavený na úplne novom základnom modeli, ale vychádza priamo z Gemini 3.7 Flash — vyššiu kvalitu dosahuje tým, že model zámerne "pracuje viac", teda spotrebúva viac takzvaných "premýšľacích" tokenov (thinking tokens) pri riešení úlohy. Google preto v dokumentácii odporúča pre úlohy, kde je prioritou efektivita (nie maximálna kvalita), zostať pri staršom modeli 3.7 Flash.

Cyber verzia

Gemini 3.8 Flash Cyber beží na rovnakom základnom modeli ako bežná verzia, líši sa však špecializáciou a obmedzeným prístupom. Podľa dostupných dát dosahuje na benchmarku CyberGym (test na vyhľadávanie zraniteľností, prevažne v jazykoch C a C++) výkon na úrovni frontier modelov, ktorý prekonáva predchádzajúcu verziu 3.5 Flash Cyber aj výrazne väčšie konkurenčné modely — presné absolútne číslo však Google vo svojom oznámení nezverejnil. Podľa DataCamp dosahuje model mieru reálneho odhalenia zraniteľností nad 70 % a nachádza sa na takzvanej Pareto hranici benchmarku CWE-Bench. Google podľa dostupných informácií zámerne uprednostnil schopnosť opravovať zraniteľnosti pred schopnosťou ich útočne zneužívať — podobný prístup k obranným bezpečnostným opatreniam ("safeguards") uplatňuje aj konkurenčný Anthropic pri svojich modeloch.

Cena a dostupnosť

Gemini 3.8 Flash má rovnakú cenu ako jeho predchodca — 0,75 dolára za milión vstupných tokenov a 3,75 dolára za milión výstupných tokenov, s cenou pre uložené (cached) vstupy na úrovni 0,075 dolára. Táto zaváděcia cena platí do 31. decembra 2026, od 1. januára 2027 sa má zdvojnásobiť na 1,50 a 7,50 dolára za milión tokenov. Dávkové (Batch) a Flex sadzby predstavujú polovicu týchto cien, prioritný (Priority) prístup naopak 1,8-násobok. K dispozícii je aj bezplatná úroveň s obmedzeným testovaním v Google AI Studio, v samotnej aplikácii Gemini je model dostupný pre predplatiteľov úrovní Google AI Pro a Ultra. Cyber variant zostáva dostupný výlučne cez program Fairwind, mimo bežného verejného vydania.

Model podporuje kontextové okno 1 milión tokenov a maximálny výstup 64-tisíc tokenov, spracúva text, obrázky, audio, video aj PDF súbory. Znalostný horizont sa podľa jednotlivých oblastí líši od januára 2025 do marca 2026.

Čo to znamená pre používateľov

Rýchly tridsaťdňový cyklus vydávania modelov z rady Flash (tri vydania za šesť týždňov) naznačuje, že Google zvolil stratégiu častých, inkrementálnych vylepšení namiesto zriedkavejších, väčších skokov — podobne ako pri predchádzajúcich verziách radí odborníci firmám používajúcim model vo veľkom objeme (napríklad v agentických pipeline spracúvajúcich milióny tokenov denne) zvážiť prechod na novšiu verziu práve pre lepší pomer kvality k cene pri rovnakej sadzbe, zatiaľ čo pri úlohách, kde je prioritou čistá efektivita a rýchlosť, môže byť podľa vlastného odporúčania Google výhodnejšie zostať pri 3.7 Flash.

← Všetky správy