Anthropic v správe "Detecting and countering misuse of AI: September 2026" zdokumentoval prípady zneužitia svojho AI modelu Claude naprieč siedmimi oblasťami: kybernetické operácie, sledovanie, dezinformačné operácie, konvenčné zbrane, biologické zneužitie, podvody a nelegálna "distilácia" (kopírovanie schopností modelu do lacnejšieho konkurenčného modelu). Firma zdôraznila, že žiadny z prípadov zneužitia sa netýkal jej najnovších modelov Claude Fable ani Mythos, s výnimkou jedného prípadu distilácie.
Najzávažnejším kybernetickým prípadom je operácia označená GTG-20006 — ruskojazyčný aktér, ktorého taktika zodpovedá skupine známej ako Midnight Blizzard, spájanej so štátnou špionážou. Skupina použila Claude na automatizáciu takmer celého životného cyklu kybernetických útokov — od prieskumu cieľov cez phishing až po exfiltráciu dát — a zamerala sa na viac než 20 organizácií vrátane ukrajinských vládnych, diplomatických a obranných inštitúcií, ako aj na dodávateľov technológie pre vojenské drony. Aktér tiež unikátnym spôsobom zneužil hotelové WiFi siete na sledovanie cieľových osôb.
V oblasti takzvanej "distilácie" — keď sa lacnejší model trénuje na výstupoch výkonnejšieho modelu, aby skopíroval jeho schopnosti — Anthropic už v júni tohto roka v liste americkým senátorom obvinil operátorov spojených s čínskou Alibabou a jej laboratóriom Qwen z doteraz najväčšej takejto kampane: približne 28,8 milióna výmen s Claude cez takmer 25-tisíc podvodných účtov medzi 22. aprílom a 5. júnom 2026. Predchádzajúce kampane pripísané labom DeepSeek, Moonshot AI a MiniMax dosahovali rádovo nižšie čísla (od 150-tisíc do 13 miliónov výmen).
Report tiež zdokumentoval prípad ruského aktéra, ktorý sa po sérii bežných kybernetických útokov na hotelové a fintech platformy pokúsil preniknúť priamo do infraštruktúry samotných AI firiem s cieľom získať prístup k ešte nezverejnenému modelu Claude — podľa Anthropicu sa mu to napriek viac než desiatim pokusom nepodarilo a firemné systémy Anthropicu kompromitované neboli.
V oblasti dezinformácií Anthropic zdokumentoval deväť prípadov naprieč Ruskom, Iránom, Tureckom, krajinami Zálivu, Južnej Ázie, Afriky aj Európy. Medzi najvýznamnejšie patrí ruská propagandistická operácia v Stredoafrickej republike prevádzkovaná cez rozhlasovú stanicu financovanú skupinou Wagner, iránske operácie troch štátnych propagandistických inštitúcií podriadených priamo iránskemu ministerstvu kultúry, a komerčná platforma na manipuláciu volieb v Malajzii, ktorá cielila na najcitlivejšie spoločenské témy — rasu, náboženstvo a monarchiu — naprieč všetkými 222 volebnými obvodmi krajiny.
Anthropic v správe zdôraznil, že vo viacerých prípadoch samotný model odmietol vykonať najagresívnejšie požiadavky — napríklad označiť konkrétne skutočné osoby za militantov s cieľom vyvolať proti nim bezpečnostný zásah, alebo vytvoriť materiál jasne určený na politickú diskreditáciu.
Pre bežného čitateľa je táto správa dôležitá ako pripomienka, že hranica medzi štátom sponzorovanými a jednotlivými útočníkmi sa vďaka dostupnosti AI stiera — podľa Anthropicu už dnes jednotlivec s ukradnutými prístupovými kľúčmi dokáže viesť kampane v rozsahu, ktorý si predtým vyžadoval celé tímy skúsených operátorov.
