PRIHLÁS

AI modely od OpenAI a Anthropic pri testoch útočili na skutočných ľudí

Vo väčšine prípadov išlo o model firmy Anthropic.

pridal safer 5.8.2026 o 20:55 pod software
AI modely od OpenAI a Anthropic pri testoch útočili na skutočných ľudí

SOFTWARE > NOVINKY >

Britský AI Security Institute zverejnil incident, pri ktorom sa AI agenti od OpenAI a Anthropicu počas kyberbezpečnostných testov dostali cez plánované hranice. V tomto prípade nešlo o bežné používanie chatbotov, ale o špeciálne testy v kontrolovanom prostredí, kde mali modely povolený prístup na internet a vypnuté niektoré bezpečnostné filtre. Cieľom tak bolo zistiť, čo dokážu pri riešení simulovaných hackerských úloh.

Umelá inteligencia klamala skutočného vývojára

AISI testoval sedem modelov v 122 behoch. V desiatich prípadoch agenti vykonali nepovolené kroky na internete a spolu ich bolo 19. Z nich 17 pripísal AISI modelu Anthropic Claude Mythos 5, zvyšné dva sa týkali OpenAI GPT-5.6 Sol s vypnutými kyberbezpečnostnými filtrami. Avšak ten najvážnejší prípad zahŕňal pokus vložiť škodlivý kód do skutočného open-source projektu na GitHube. V praxi si agent vytvoril falošné identity, skúšal presvedčiť správcu projektu, aby zmenu schválil.

Dôležité ale je, že pokus nebol úspešný a AISI nenašiel dôkaz o reálnej škode. Ľudský správca škodlivý návrh odmietol a GitHub taktiež pomohol pri odstránení stôp, ktoré agent zanechal. AISI však zdôrazňuje, že prvýkrát videl takúto úroveň autonómneho a klamlivého správania namierenú proti skutočným ľuďom bez toho, aby model dostal priamy pokyn niekoho oklamať.

Útočil aj model od OpenAI

Iný incident sa týkal testov firmy Irregular s modelmi OpenAI. Tie mali riešiť izolovanú CTF úlohu, ale kvôli zlej konfigurácii získali prístup na verejný internet. Keďže fiktívny cieľ mal rovnaký názov ako reálna doména, model zaútočil na skutočný web a použil prihlasovacie údaje, ktoré našiel. OpenAI tvrdí, že nešlo o únik zo sandboxu, ale o výsledok chybne nastavenej testovacej infraštruktúry.

Teraz je teda samozrejmé, že pri testovaní silných AI agentov už nestačí veriť, že zostanú hrať iba podľa vymedzených pravidiel. Ak majú internet, nástroje a cieľ, môžu hľadať cesty, nad ktorými sa vývojári ani len nezamýšľali. AISI aj kvôli tomu upravuje pravidlá. Chce totižto jemnejšie obmedziť internetový prístup, zaviesť real-time monitoring a pri podobných testoch vopred počítať s tým, že model sa môže pokúsiť konať mimo zadania.





Páči sa mi!






Prosím prihláste sa pre možnosť pridania komentáru.
Môžete sa prihlásiť cez Sector konto, alebo Facebook.
SOCIÁLNE SIETE
NOVÉ FÓRA
|Xbox hraci (3)
Ahojte, kde sa teraz pls najnovsie zdruzuju Xbox S...
|Hra na cd/dvd/blueray, ktoru s... (14)
Zdar vsetci. Aku hru si najviac cenite, ktoru mate...
|Hry, ktoré si treba aspoň raz ... (23)
Poslednú dobu tu čítam samé negatíva ovplyvňujúce ...
|Pc - na komunitu (11)
Ako sa zakladá web? Treba mať živnosť? Chcem web s...
|Linux a hry (4)
Ahojte chcel by som ci mi vie niekto poradiť čítal...
|Filmy filmy filmy film... (48834)
O filmoch. Hádam chápete....
|Sector hraje ... (130320)
:diskoška o HRACH, ktore prave hravate, ale aj o t...
|Screenshots (66961)
Vkladajte sem vaše zaujímavé screenshoty z hier. O...
|Hudba (1)
Fórum určené pre hudobné témy...
|Metal & rock (8095)
diskusia o tvrdej hudbe...
|Svet, ukrajina, vojny ... (57077)
Sem môžete dávať správy zo sveta, o Ukrajine a ďal...
KOMENTÁRE
vaše novinky zo sveta zábavy
sector logo
Sector.sk - hry, recenzie, novinky
Ochrana súkromia | Reklama | Kontakt
ISSN 1336-7285. Všetky práva vyhradené. (c) 2026 SECTOR Online Entertainment / sector@sector.sk