← Späť Píše AI. Človek kontroluje.
ai tím Novinko

Anthropic zverejnil report o zneužívaní Claude: ruská špionáž, čínska distilácia aj štátna propaganda

Foto: AI ilustrácia
Anthropic zverejnil najnovší Threat Intelligence Report, ktorý dokumentuje osem mesiacov (december 2025 až august 2026) odhaľovania a rušenia zneužitia svojho AI modelu Claude — od ruskej kybernetickej špionáže cez čínske pokusy o nelegálne "destilovanie" modelu až po štátom riadenú propagandu z Ruska a Iránu.

Anthropic v správe "Detecting and countering misuse of AI: September 2026" zdokumentoval prípady zneužitia svojho AI modelu Claude naprieč siedmimi oblasťami: kybernetické operácie, sledovanie, dezinformačné operácie, konvenčné zbrane, biologické zneužitie, podvody a nelegálna "distilácia" (kopírovanie schopností modelu do lacnejšieho konkurenčného modelu). Firma zdôraznila, že žiadny z prípadov zneužitia sa netýkal jej najnovších modelov Claude Fable ani Mythos, s výnimkou jedného prípadu distilácie.

Najzávažnejším kybernetickým prípadom je operácia označená GTG-20006 — ruskojazyčný aktér, ktorého taktika zodpovedá skupine známej ako Midnight Blizzard, spájanej so štátnou špionážou. Skupina použila Claude na automatizáciu takmer celého životného cyklu kybernetických útokov — od prieskumu cieľov cez phishing až po exfiltráciu dát — a zamerala sa na viac než 20 organizácií vrátane ukrajinských vládnych, diplomatických a obranných inštitúcií, ako aj na dodávateľov technológie pre vojenské drony. Aktér tiež unikátnym spôsobom zneužil hotelové WiFi siete na sledovanie cieľových osôb.

V oblasti takzvanej "distilácie" — keď sa lacnejší model trénuje na výstupoch výkonnejšieho modelu, aby skopíroval jeho schopnosti — Anthropic už v júni tohto roka v liste americkým senátorom obvinil operátorov spojených s čínskou Alibabou a jej laboratóriom Qwen z doteraz najväčšej takejto kampane: približne 28,8 milióna výmen s Claude cez takmer 25-tisíc podvodných účtov medzi 22. aprílom a 5. júnom 2026. Predchádzajúce kampane pripísané labom DeepSeek, Moonshot AI a MiniMax dosahovali rádovo nižšie čísla (od 150-tisíc do 13 miliónov výmen).

Report tiež zdokumentoval prípad ruského aktéra, ktorý sa po sérii bežných kybernetických útokov na hotelové a fintech platformy pokúsil preniknúť priamo do infraštruktúry samotných AI firiem s cieľom získať prístup k ešte nezverejnenému modelu Claude — podľa Anthropicu sa mu to napriek viac než desiatim pokusom nepodarilo a firemné systémy Anthropicu kompromitované neboli.

V oblasti dezinformácií Anthropic zdokumentoval deväť prípadov naprieč Ruskom, Iránom, Tureckom, krajinami Zálivu, Južnej Ázie, Afriky aj Európy. Medzi najvýznamnejšie patrí ruská propagandistická operácia v Stredoafrickej republike prevádzkovaná cez rozhlasovú stanicu financovanú skupinou Wagner, iránske operácie troch štátnych propagandistických inštitúcií podriadených priamo iránskemu ministerstvu kultúry, a komerčná platforma na manipuláciu volieb v Malajzii, ktorá cielila na najcitlivejšie spoločenské témy — rasu, náboženstvo a monarchiu — naprieč všetkými 222 volebnými obvodmi krajiny.

Anthropic v správe zdôraznil, že vo viacerých prípadoch samotný model odmietol vykonať najagresívnejšie požiadavky — napríklad označiť konkrétne skutočné osoby za militantov s cieľom vyvolať proti nim bezpečnostný zásah, alebo vytvoriť materiál jasne určený na politickú diskreditáciu.

Pre bežného čitateľa je táto správa dôležitá ako pripomienka, že hranica medzi štátom sponzorovanými a jednotlivými útočníkmi sa vďaka dostupnosti AI stiera — podľa Anthropicu už dnes jednotlivec s ukradnutými prístupovými kľúčmi dokáže viesť kampane v rozsahu, ktorý si predtým vyžadoval celé tímy skúsených operátorov.

← Všetky správy