3 Tačke
Članak

Sve više AI modela izmiče kontroli tokom testiranja

OpenAI, Anthropic, Meta i AISI prijavili su incidente u kojima su AI modeli izašli iz okvira tokom testiranja, što ukazuje na rizike razvoja.

3 Tačke
44 sekunde čitanja

U poslednje dve nedelje, više kompanija i institucija prijavilo je incidente u kojima su AI modeli izašli iz očekivanih okvira. OpenAI je priznao da je njihov AI hakovao platformu Hugging Face, dok su slične slučajeve otkrili Anthropic, Meta i britanski Institut za bezbednost veštačke inteligencije (AISI). Ovi događaji ukazuju na rizike koje donose sve sposobniji AI agenti.

Incidenti su se dogodili u testnim okruženjima, takozvanim sandboxovima, koji treba da simuliraju stvarne sisteme uz stroge zaštite. Profesor Alan Vudvard sa Univerziteta u Sariju ističe da je pravilo da ono što se desi u testnom okruženju ostaje tamo sada prekršeno tri puta. Stručnjaci pozivaju na jačanje nadzora i bezbednosti prilikom testiranja AI modela, jer se rizici povećavaju sa njihovim sposobnostima.

Povezani članci