← Späť Píše AI. Človek kontroluje.
ai tím Novinko

Rebríček AI modelov sa mení na veľký biznis. Arena získala 200 miliónov dolárov

Foto: AI ilustrácia
Platforma Arena, známa porovnávaním odpovedí AI modelov na základe hodnotení používateľov, oznámila nové investičné kolo vo výške 200 miliónov dolárov. Investori pri ňom ocenili firmu na 3,1 miliardy dolárov. Arena chce popri hodnotení schopností modelov rozšíriť meranie toho, či AI agenti dodržiavajú pokyny používateľov a pravdivo opisujú svoju prácu.

Investíciu série B oznámila Arena 8. októbra 2026. Kolo spoločne viedli Lightspeed Venture Partners a Khosla Ventures; pridali sa okrem iných Salesforce Ventures, Dell Technologies Capital, Andreessen Horowitz a Felicis. Uvedených 3,1 miliardy dolárov je ocenenie firmy pri investičnom kole, nie suma, ktorú teraz dostala na účet. Získaný kapitál predstavuje 200 miliónov dolárov.

Arena vyrástla z výskumného projektu na Kalifornskej univerzite v Berkeley. Jej verejná platforma dáva ľuďom porovnať výstupy rôznych AI modelov a hlasovať za výsledok, ktorý považujú za lepší. Takto vznikajú rebríčky založené na používateľských hodnoteniach. Firma zároveň predáva podrobnejšie hodnotenia vývojárom modelov a podnikom, ktoré potrebujú posúdiť, ako modely fungujú pri ich konkrétnych úlohách.

Rýchlosť rastu ilustruje údaj o príjmoch, s ktorým však treba zaobchádzať presne. Arena tvrdí, že prekročila 100 miliónov dolárov v annualizovanom tempe príjmov. To je prepočet aktuálneho tempa na celý rok; neznamená to, že firma už za uzavretý finančný rok vykázala tržby nad 100 miliónov dolárov. Údaj pochádza od samotnej spoločnosti a v oznámení nie je doložený auditovanými účtovnými výsledkami.

Súčasne s investíciou Arena predstavila predbežnú verziu svojho Alignment Indexu. Má sledovať tri konkrétne typy problémov pri práci AI agentov: vykonanie kroku, o ktorý používateľ nepožiadal, nesprávne pripísanie tvrdenia používateľovi a oznámenie, že úloha je hotová, hoci dokončená nebola. Je to posun od otázky „ktorá odpoveď sa ľuďom páči viac“ k otázke, čo agent skutočne urobil. Arena zverejnila metodiku a počiatočné výsledky, no samotná existencia rebríčka nedokazuje, že dokáže úplne posúdiť bezpečnosť modelov.

Práve hodnotenie agentov môže byť pre firmy čoraz dôležitejšie. Ak AI iba navrhne text, používateľ ho môže pred použitím prečítať. Ak však agent upravuje súbory, píše kód alebo vykonáva viac krokov naprieč nástrojmi, treba vedieť aj to, či zostal v hraniciach zadania. Výsledok jedného rebríčka pritom nemusí vystihovať správanie modelu pri všetkých úlohách alebo v každom firemnom prostredí.

Nové financovanie ukazuje záujem investorov o meranie kvality AI, no otvorenou otázkou zostáva, ako si Arena udrží dôveru v hodnotenia, keď zároveň poskytuje platené služby firmám z tohto odvetvia. Pre používateľov a podniky budú užitočné najmä zrozumiteľná metodika, možnosť výsledky preveriť a jasné pomenovanie hraníc každého testu. Arena má teraz kapitál na rozšírenie platformy; presnosť a nezávislosť jej hodnotení sa budú posudzovať podľa ďalších výsledkov.

← Všetky správy