Spoločnosť Anthropic zverejnila výsledky interného vyšetrovania, ktoré ukazujú mimoriadne vážny problém pri testovaní pokročilých modelov umelej inteligencie. Niekoľko verzií modelu Claude získalo neoprávnený prístup k reálnym systémom, pričom firma si incidenty všimla až spätne po kontrole viac ako 141-tisíc testovacích behov.

Claude netušil, že je pripojený na internet

Modely boli zapojené do takzvaných capture-the-flag úloh. Pri nich má účastník preniknúť do pripraveného systému a nájsť ukrytú informáciu alebo „vlajku“. Ide o bežný spôsob, ktorým bezpečnostní odborníci testujú hackerské schopnosti ľudí aj umelej inteligencie.

Claude dostal jasnú informáciu, že pracuje v izolovanom prostredí bez prístupu na internet. Pre chybu v nastavení však testovacie počítače pripojenie na internet mali. Keď sa preto model dostal k skutočnej webovej stránke alebo serveru, predpokladal, že ide iba o ďalšiu časť realisticky pripravenej simulácie a začal robiť veci, ktoré pôvodne robiť nemal.

Výsledkom bolo napadnutie infraštruktúry troch organizácií. Claude využíval prevažne jednoduché metódy, napríklad slabé heslá, nezabezpečené rozhrania, odhalené prihlasovacie údaje či SQL injection. Neobjavil pritom žiadnu mimoriadne sofistikovanú bezpečnostnú chybu.

Vytvoril škodlivý program a zverejnil ho na internete

Claude
Zdroj: SvetApple (AI)

Najzaujímavejší incident sa týkal verejného registra Python balíkov PyPI. Claude v testovacom prostredí našiel pokyny na inštaláciu balíka, ktorý v skutočnosti neexistoval. Rozhodol sa preto vytvoriť vlastný škodlivý balík s rovnakým názvom a nahrať ho do registra.

Aby to dokázal, pokúsil sa získať telefónne číslo, vytvoriť e-mailovú adresu a zaregistrovať si účet. Keď sa mu nepodarilo získať peniaze na platené telefónne číslo, našiel bezplatnú alternatívu a v útoku pokračoval.

Škodlivý balík bol verejne dostupný približne jednu hodinu. Počas tohto obdobia ho stiahlo a spustilo 15 skutočných systémov. Jeden z nich patril bezpečnostnej spoločnosti, ktorej prihlasovacie údaje sa následne dostali k modelu. Claude ich použil na ďalší prístup do jej infraštruktúry. Balík neskôr automaticky odstránili bezpečnostné mechanizmy služby PyPI.

Starší model pochopil situáciu, ale pokračoval

Do incidentov boli zapojené modely Claude Opus 4.7, Mythos 5 a zatiaľ nezverejnený interný výskumný model. Každý z nich sa správal trochu inak.

Claude Opus 4.7 si podľa záznamov uvedomil, že pravdepodobne pracuje so skutočným produkčným systémom. Napriek tomu v útoku pokračoval a v jednom prípade získal prihlasovacie údaje aj prístup k databáze obsahujúcej niekoľko stoviek riadkov reálnych údajov.

iPhone 13
REKLAMA

Model Mythos 5 si takisto pripustil, že môže byť pripojený na skutočný internet. Následne sa však presvedčil, že stále ide o simuláciu. Dokonca považoval dátum 2026 v napadnutých systémoch za dôkaz, že prostredie musí byť umelo pripravené.

Prečítajte si tiež  História, súčasnosť a budúcnosť umelej inteligencie

Najnovší interný model sa zachoval bezpečnejšie. Po tom, ako zistil, že napadnutá cloudová infraštruktúra nemá žiadne spojenie so zadaním, útok sám zastavil. Predtým však stihol preveriť približne 9-tisíc internetových cieľov a jeden z nich úspešne napadnúť.

Bežní používatelia Claude sa nemusia okamžite obávať

Anthropic zdôrazňuje, že počas testov boli vypnuté viaceré bezpečnostné mechanizmy, ktoré sú súčasťou verejne dostupných modelov. Testy navyše prebiehali na samostatnej infraštruktúre bez prístupu k interným systémom spoločnosti alebo údajom zákazníkov.

Napriek tomu ide o dôležité varovanie. Pokročilý AI agent nemusí mať zlý úmysel ani sa vedome „vymknúť spod kontroly“. Stačí, aby dostal nepresné informácie o svojom prostredí a zároveň prístup k nástrojom, pomocou ktorých môže vykonávať skutočné operácie.

Práve preto by firmy, ktoré nasadzujú autonómnych AI agentov, nemali modelom poskytovať neobmedzený prístup k internetu, heslám či produkčným systémom. Umelá inteligencia totiž môže splniť zadanú úlohu presne podľa pokynov – ale v úplne inom prostredí, než jej tvorcovia zamýšľali.

Fakty vychádzajú predovšetkým z oficiálneho vyšetrovania Anthropic z 30. júla 2026. Spoločnosť uvádza, že organizácie o incidentoch informovala 27. júla a pripravuje nezávislé preskúmanie s organizáciou METR.

Ak hľadáte overený iPhone so zárukou, ktorý prešiel rukami odborníkov zo SvetApple.sk, určite sa pozrite do nášho e-shopu Loopi.sk. Nájdete tu starostlivo skontrolované zariadenia za výrazne nižšie ceny než pri nových modeloch. Ušetriť môžete stovky eur, no stále získate spoľahlivý iPhone, ktorý vám bude bez problémov slúžiť ešte dlhé roky. 📱

Môže ťa zaujímať