← Späť Píše AI. Človek kontroluje.
ai tím Novinko

Nemecko vstupuje do boja o výkonné AI modely. Kolibri má byť európskou odpoveďou na americkú a čínsku dominanciu

Foto: AI ilustrácia
Európa získala ďalší veľký jazykový model vyvinutý na vlastnom území. Nemecká spoločnosť Aleph Alpha predstavila Kolibri-1, otvorený model s 78 miliardami parametrov, ktorý je možné prevádzkovať na vlastnej infraštruktúre. V niektorých testoch matematiky, programovania a logického uvažovania dokázal konkurovať alebo prekonať modely spoločností Alibaba, Nvidia a Mistral.

Nemecká AI spoločnosť Aleph Alpha predstavila 3. októbra nový veľký jazykový model Kolibri-1. Firma ho označuje za suverénny európsky model určený predovšetkým pre organizácie, ktoré nechcú pri práci s umelou inteligenciou posielať citlivé dáta do systémov zahraničných poskytovateľov.

Kolibri je postavené na architektúre Mixture-of-Experts (MoE). Celkovo obsahuje približne 78,1 miliardy parametrov, pri spracovaní jedného tokenu však využíva iba približne 3,46 miliardy. Namiesto aktivovania celého modelu systém vyberá iba tie časti neurónovej siete, ktoré sú pre konkrétnu úlohu potrebné. Výsledkom má byť nižšia výpočtová náročnosť pri zachovaní výkonu veľkého modelu.

Model bol od začiatku navrhovaný pre nemčinu a angličtinu. Podporuje režim pokročilého uvažovania, používanie externých nástrojov a dokáže pracovať s kontextom až približne jedného milióna tokenov. Pri praktickom nasadení však samotná Aleph Alpha pre náročnejšie úlohy odporúča menšie kontextové okno do približne 262-tisíc tokenov.

Z európskeho pohľadu je podstatné aj to, že Kolibri nemusí fungovať iba ako vzdialená cloudová služba. Organizácie si môžu stiahnuť jeho váhy a model prevádzkovať na vlastnej infraštruktúre. Aleph Alpha ho vydala pod licenciou Apache 2.0, ktorá umožňuje široké používanie a úpravy modelu vrátane komerčných aplikácií.

Práve možnosť vlastného nasadenia je jedným z hlavných významov projektu. Pre úrady, priemyselné podniky alebo organizácie pracujúce s citlivými údajmi môže byť dôležité, aby dokumenty nemuseli opustiť ich vlastnú infraštruktúru. Aleph Alpha preto Kolibri prezentuje predovšetkým ako model pre verejnú správu, priemysel a ďalšie regulované oblasti.

Pozornosť však získali najmä jeho výsledky v benchmarkoch. V anglickej verzii matematického testu AIME 2026 dosiahlo Kolibri podľa meraní Aleph Alpha 96 percent. Qwen3.6 35B-A3B dosiahol v rovnakom porovnaní 91 percent, Nemotron 3 Super 90,4 percenta a Mistral Small 4 približne 83,1 percenta.

Podobne dopadol vedecko-logický benchmark GPQA Diamond, kde Kolibri dosiahlo 84,3 percenta. Qwen3.6 zaznamenal 83,4 percenta, Nemotron 78 percent a Mistral Small 4 približne 74,7 percenta.

Kolibri však nevyhráva všetky testy. Napríklad pri MMLU-Pro dosiahlo v angličtine 80 percent, zatiaľ čo Qwen3.6 získal 84,3 percenta a Nemotron 82,7 percenta. Aj pri niektorých testoch používania nástrojov zostáva Qwen pred nemeckým modelom.

Výsledky navyše pochádzajú predovšetkým z hodnotenia samotnej Aleph Alpha. Firma uvádza, že porovnávané modely testovala rovnakým evaluačným systémom, stále však nejde o úplne nezávislé potvrdenie toho, že Kolibri je celkovo výkonnejšie než jeho konkurenti. Jednotlivé benchmarky navyše zachytávajú iba určitú časť schopností jazykových modelov.

Zaujímavá je preto skôr kombinácia výkonu a výpočtovej efektivity. Kolibri aktivuje pri jednom tokene iba približne 4,4 percenta svojich celkových parametrov. Aleph Alpha tvrdí, že v pomere kvality a nákladov na prevádzku sa model dostáva medzi najefektívnejšie systémy vo svojej kategórii.

Kolibri zároveň ukazuje širšiu snahu Európy znížiť závislosť od amerických a čínskych AI technológií. Najvýkonnejšie komerčné systémy dnes pochádzajú predovšetkým od spoločností ako OpenAI, Google, Anthropic či čínskych vývojárov Alibaba a DeepSeek. Európa má vlastných hráčov vrátane francúzskeho Mistralu, švajčiarskeho projektu Apertus a teraz aj ďalšiu generáciu modelov Aleph Alpha.

Kolibri zatiaľ nemožno označiť za jednoznačne najlepší európsky či svetový AI model. Jeho vydanie však ukazuje, že súboj o veľké jazykové modely sa už netýka iba absolútneho výkonu. Čoraz dôležitejšie sú náklady na prevádzku, možnosť spustiť model na vlastnom hardvéri, kontrola nad dátami a schopnosť krajín či organizácií nebyť úplne závislé od niekoľkých globálnych technologických spoločností.

← Všetky správy