Pomocník, nebo digitální zbraň? Anthropic promluvil o děsivém zneužití své AI
S nejnovějším zjištěním přišel Anthropic. Odhalil, že jeho model Claude se pokoušely zneužívat hackerské skupiny k celé řadě škodlivých aktivit. A v některých případech už umělá inteligence nefungovala pouze jako pomocník. Zvládla prakticky celý útok.
Anthropic sledoval zneužívání svého modelu od prosince 2025 do srpna 2026. Claude se útočníci pokoušeli zapojit do kybernetických a vlivových operací, špionáže či podvodů. Firma zaznamenala také jeho zneužívání při vývoji biologických a konvenčních zbraní.
Mezi aktéry, kteří možnosti umělé inteligence zneužívali, byli finančně motivovaní kyberzločinci i hackerské skupiny, spojované s Ruskem a Čínou.
Mohlo by vás zajímat
Digitální vandalismus: firma Anthropic zničila miliony knih kvůli trénování své umělé inteligence
Hackeři prověřili 1,8 milionu aplikací pro Android. Hledali v nich přístupové údaje
Jedním z případů, který Anthropic popisuje, jsou aktivity spojované s hackerskou skupinou ShinyHunters. Ta je známá rozsáhlými krádežemi dat, kterým často předchází sociální inženýrství a napadení uživatelských účtů.
Údajný francouzsky hovořící člen skupiny, vystupující pod přezdívkou „frkoo“, vytvořil automatizovaný systém, který pracoval na deseti cloudových serverech AWS EC2. Jeho prostřednictvím hromadně stahoval aplikace pro Android z několika obchodů.
Tímto způsobem se mu podařilo získat celkem 1,8 milionu různých instalačních balíčků APK. Následně je dekompiloval, tedy převedl do podoby, ve které lze podrobněji analyzovat jejich obsah. Pomocí nástroje TruffleHog v nich nakonec vyhledával citlivá data, například přístupové údaje a klíče.
Mohlo by vás zajímat
Šance na vyhlazení lidstva stoupne nad 10 %. Experti varují před následující dekádou vývoje AI
Po ověření byly nálezy odesílány do skupiny na Telegramu, a to v reálném čase. Tam byly poté rozděleny do více než stovky kategorií.
Další automatizovaný systém útočník používal ke shromažďování e-mailových adres organizací na GitHubu. Jeho cílem bylo získávání osobních přístupových tokenů GitHub PAT, které mohou sloužit k ověřování přístupu k účtům a dalším zdrojům.
Právě přístupové údaje získané těmito dvěma způsoby byly podle Anthropicu použity při většině potvrzených průniků spojovaných s tímto hackerem.
Od jediného ukradeného tokenu k administrátorskému účtu za necelé tři hodiny
Ještě zajímavější je rychlost, s jakou útočníci dokázali díky automatizaci postupovat:
V jednom z případů trvalo podezřelému členovi ShinyHunters přibližně 34 hodin, než získal více než 2 100 sad autentizačních tokenů Azure AD spojených s více než 40 firemními prostředími Microsoftu. Podle Anthropicu přitom AI agenti vykonali téměř veškerou práci.
V jiném případě stačily útočníkovi méně než tři hodiny k tomu, aby se od jediného ukradeného vývojářského tokenu propracoval až k plné administrátorské kontrole napadeného prostředí.
U jiné softwarové společnosti přešli hackeři od prvotního průniku k hromadnému odcizení dat během pouhých několika hodin.
Aktivity spojované se ShinyHunters zahrnovaly také napadení technologické společnosti a krádež jednoho terabajtu dat, kompromitaci letecké společnosti nebo průnik do systémů energetické firmy. V jednom případě útočníci napadli poskytovatele cloudové služby a odcizili data přibližně dvou stovek jeho zákazníků.
Mohlo by vás zajímat
Pošlete nám přístupový klíč a ochráníme vás. Ruští hackeři vymysleli nebezpečný nový podvod
Ruští hackeři zapojili Claude do všech fází útoku
Možnosti Claude podle Anthropicu zneužívala také ruská špionážní skupina Midnight Blizzard. V jejím případě už umělá inteligence zasahovala prakticky do celého řetězce kybernetického útoku. Pomáhala automatizovat vývoj malwaru, vyhledávání informací, získávání potřebné infrastruktury, phishing, udržování přístupu do napadených systémů, komunikaci mezi malwarem a útočníky i odcizování dat.
Hackeři dokonce vytvořili automatickou zpětnou vazbu. Pokud bezpečnostní software jejich malware odhalil, systém jej znovu sestavil tak, aby se detekci pokusil vyhnout.
Anthropic zaznamenal útoky Midnight Blizzard proti více než dvaceti vládním, obranným, diplomatickým, zpravodajským a zahraničněpolitickým organizacím.
Používané metody byly velmi pestré. Patřil mezi ně phishing, útoky typu ClickFix, převzetí účtů WhatsApp, krádeže cloudových e-mailů nebo šíření malwaru pro Windows, Android a iOS. Prostřednictvím napadených poskytovatelů hotelových Wi-Fi útočníci dokonce přesměrovávali DNS.
Zajímavý je také způsob činnosti. Útočníci své operace automatizovali prostřednictvím pracovních postupů založených na AI a funkcích Claude Code. Člověk do nich zasahoval především tehdy, když bylo potřeba jednotlivé postupy upravit.
Mohlo by vás zajímat
Miliony e-mailů se skrytými znaky: Microsoft objevil sofistikovaný upgrade starého podvodu
AI hledala bezpečnostní chyby, zatímco hackeři nebyli u počítače
Anthropic zaznamenal podobný posun k automatizaci také u čínsky hovořící špionážní skupiny označované GTG-10007.
Claude zde fungoval jako technologická a řídicí vrstva rozsáhlejší útočné infrastruktury. Skupina jej používala například při pokusech o průnik do produkčních systémů, průzkumu sítí zahraničních vlád, vývoji malwaru nebo hledání zranitelností v bezpečnostních produktech.
A právě zde se ukazuje jedna z vlastností AI, která může být z pohledu kybernetické bezpečnosti velmi nepříjemná: Automatizované systémy mohou pracovat i bez průběžného dohledu člověka.
Skupina nechávala autonomní procesy vyhledávat zranitelnosti dokonce i v době, kdy samotní operátoři nebyli aktivní. Tímto způsobem se podařilo objevit ve významném bezpečnostním produktu několik chyb, které do té doby nebyly známé.
Automatizovaný systém navíc vytvořil funkční exploity (tedy kódy využívající nalezené chyby) pro několik rodin síťových a bezpečnostních zařízení. Útočníci následně tyto kódy použili proti několika vládním organizacím po celém světě.
Celkem se aktivity skupiny zaměřovaly přibližně na 50 organizací z oblasti státní správy, školství, maloobchodu, energetiky, technologií, zdravotnictví, financí a výroby.
AI útoky výrazně zrychlují: Anthropic upravil ochranné mechanismy
Popsané případy ukazují, že umělá inteligence nemusí kyberzločincům pomáhat pouze s napsáním phishingového e-mailu nebo části škodlivého kódu. Stále větší část práce lze automatizovat a některé úkoly mohou AI agenti vykonávat prakticky samostatně.
Právě rychlost a rozsah jsou v této souvislosti velmi podstatné. Pokud útočník dokáže během několika hodin automatizovat činnost, která by dříve vyžadovala mnoho dílčích kroků, může se výrazně zkrátit také čas, který mají napadené organizace na reakci.
Anthropic uvádí, že škodlivé aktivity popsaných skupin přerušil a jejich účty zablokoval. Na základě získaných zkušeností také upravil ochranné mechanismy Claude, přidal opatření pro rychlejší odhalování podobného zneužití a kontaktoval úřady, další firmy z oboru i samotné oběti.
Pro nás je ale důležitý především širší kontext: Stejné nástroje umělé inteligence, které dokážou automatizovat naši běžnou práci, mohou stejným způsobem automatizovat i práci útočníků. A právě rychlost, s jakou poté dokážou postupovat od nalezení slabého místa až k ovládnutí systému a krádeži dat, může být jednou z největších hrozeb, které AI do kybernetické bezpečnosti přináší.
Zdroj: Bleeping Computer