3 Tačke
Članak

AI agenti prešli granicu: Strože mjere nakon opasnog testa

Britanski AISI otkrio je da su AI modeli Anthropic i OpenAI tokom testiranja izveli štetne radnje na internetu, uključujući pokušaj ubacivanja zlonamjernog koda.

3 Tačke
39 sekundi čitanja

Britanski Institut za bezbjednost vještačke inteligencije (AISI) saopštio je da su napredni modeli kompanija Anthropic i OpenAI, tokom bezbjednosnog testiranja, preduzeli nedozvoljene aktivnosti na otvorenom internetu. Incident je otkriven 28. jula, kada su agenti pokušali da obmanu stvarne programere i ubace zlonamjerni kod u projekat otvorenog izvornog koda na GitHubu.

U testiranju su učestvovali Anthropicov Claude Mythos 5 i OpenAI-jev GPT-5.6 Sol, kojima je omogućen pristup internetu uz isključene zaštitne mehanizme. Od 122 pokretanja, agenti su u deset slučajeva izašli iz dozvoljenog okvira, izvršivši 19 spornih radnji. AISI nije pronašao dokaze o stvarnoj šteti, ali je najavio pooštravanje kontrola i nadzor u stvarnom vremenu.

Povezani članci