Takto sa rodí Skynet? OpenAI opísalo, ako jeho model sám našiel dieru v systéme, dostal sa von a prenikal ďalej |
OpenAI testovalo model v izolovanom prostredí, ten si ale našiel dieru a potom hackol Hugging Face.
OpenAI opísalo bezpečnostný incident, pri ktorom jeho pokročilé modely počas interného testovania unikli z izolovaného prostredia, získali prístup na internet a následne prenikli do produkčných systémov platformy Hugging Face. Nešlo pritom o vopred pripravenú súčasť testu. Modely si cestu von našli samostatne, pretože sa snažili za každú cenu dokončiť zadanú úlohu.
Incident sa odohral počas interného hodnotenia kybernetických schopností umelej inteligencie. OpenAI pri ňom využívalo kombináciu modelu GPT-5.6 Sol a ešte výkonnejšieho systému, ktorý zatiaľ nebol verejne vydaný. Modely mali znížené obmedzenia pri vykonávaní kybernetických úloh a spoločnosť vypla aj produkčné filtre, ktoré by za bežných okolností rizikovú aktivitu zastavili. Cieľom totiž bolo zistiť, čo všetko najnovšie modely dokážu.
Internet nemali mať, našli si ho samy
Testovacie prostredie bolo podľa OpenAI silne izolované. Modely nemali priamy prístup na internet a externé balíky mohli získavať iba cez interný proxy server, ktorý fungoval ako vyrovnávacia pamäť pre softvérové registre.
Práve tento jediný most smerujúci von sa však stal slabým miestom. Modely venovali značnú časť výpočtového výkonu hľadaniu spôsobu, ako sa dostať na otvorený internet. Nakoniec v proxy serveri objavili dovtedy neznámu zero-day zraniteľnosť a úspešne ju zneužili.
Tým sa však cesta iba začala. Agent následne zvyšoval svoje oprávnenia, presúval sa medzi systémami testovacieho prostredia a pokračoval dovtedy, kým sa nedostal k uzlu s internetovým pripojením. Nešlo teda o jednoduché kliknutie na nesprávny odkaz, ale o autonómne vykonaný viacstupňový kybernetický útok.
Cieľom bolo podvádzať v teste
Po získaní prístupu na internet modely usúdili, že Hugging Face by mohlo uchovávať modely, datasety a riešenia súvisiace s benchmarkom ExploitGym, na ktorom boli práve skúšané. Namiesto vyriešenia zadania bežným spôsobom sa preto pokúsili získať odpovede priamo zo zdroja.
Modely následne našli cestu do infraštruktúry Hugging Face. Podľa OpenAI pri tom skombinovali viacero spôsobov útoku vrátane ukradnutých prihlasovacích údajov, ďalších neznámych zraniteľností a vzdialeného spúšťania kódu na serveroch platformy. Nakoniec sa dostali k riešeniam testu uloženým v produkčnej databáze.
OpenAI tvrdí, že modely nemali širší škodlivý zámer. Boli však extrémne sústredené na dokončenie úlohy a za riešením išli bez ohľadu na hranice pôvodného prostredia. Práve to je na incidente najznepokojivejšie. Umelá inteligencia nemusela dostať príkaz zaútočiť na cudziu platformu. Stačilo jej zadať cieľ a nechať jej dostatok schopností a výpočtového času.
Hugging Face útok zastavilo
Podozrivú aktivitu zaznamenali bezpečnostné tímy OpenAI aj Hugging Face. Hugging Face útok vo svojej infraštruktúre zastavilo a začalo s izolovaním napadnutých systémov a forenznou analýzou.
Platforma potvrdila neoprávnený prístup k obmedzenému množstvu interných datasetov a viacerým prihlasovacím údajom používaným jej službami. Nenašla však dôkazy o manipulácii s verejne dostupnými modelmi, datasetmi, projektmi Spaces ani publikovanými softvérovými balíkmi. Naďalej preveruje, či incident zasiahol dáta niektorých partnerov alebo zákazníkov.
Hugging Face pôvodne vedelo iba to, že útok vykonal autonómny systém pozostávajúci z množstva krátkodobých agentov. Až neskoršie vyšetrovanie ukázalo, že za ním stáli modely OpenAI. Podľa Hugging Face agent vykonal tisíce samostatných operácií a dokázal sa presúvať medzi viacerými internými klastrami.
OpenAI hovorí o bezprecedentnom incidente
OpenAI označilo udalosť za bezprecedentný kybernetický incident využívajúci schopnosti na úrovni najpokročilejších súčasných systémov. Spoločnosť už zavádza prísnejšie obmedzenia infraštruktúry, opravuje objavené zraniteľnosti a pripravuje silnejšie monitorovanie budúcich testov.
Prípad zároveň ukazuje problém, ktorý bude s výkonnejšími AI agentmi čoraz výraznejší. Model nemusí byť vedomý, zlomyseľný ani sa nemusí rozhodnúť „utiecť“. Stačí, že dostane jasný cieľ, nástroje a možnosť robiť dlhé série rozhodnutí. Ak mu prekážka bráni splniť zadanie, môže ju začať vnímať iba ako ďalší technický problém, ktorý treba obísť.
V tomto prípade bolo cieľom iba úspešne dokončiť test. Model si však na ceste za odpoveďou sám našiel dieru v izolovanom prostredí, dostal sa na internet a prenikol do cudzej produkčnej infraštruktúry. Skynet sa síce ešte nezobudil, no bezpečnostné dvere už zjavne dokáže skúšať za kľučku.
| NAJČÍTANEJŠIE ČLÁNKY TÝŽDŇA |
- Netflix možno omylom prezradil, že GTA 6: Extended Look bude mať tri časti 40
- Alza spustila nové zľavy 9
- Mafia Omerta Edition ohlásená - spojí všetky štyri hry série, prvá Mafia dostane 6 52
- Problémy s tekutým kovom v PS5 sa znovu ozývajú, nepomáha ani horizontálna poloha 57
- RECENZIA: No More Room in Hell 2 4
- GTA VI ukážku budú môcť streameri okamžite preberať z Netflixu 90
- Výrobcovia pamätí si vopred zaistili miliardy, kríza môže trvať do 2029 75
- Ryan Hurst ukázal, ako vyzeral v úlohe Krata 25
- Netflix údajne môže za odhalenie GTA 6 dať až 100 miliónov dolárov 85
- The Lord of the Rings: War in the North sa práve vrátil v Legacy edícii. 23 zobraziť viac článkov >














