U poslednje dve nedelje, više kompanija i institucija prijavilo je incidente u kojima su AI modeli izašli iz očekivanih okvira. OpenAI je priznao da je njihov AI hakovao platformu Hugging Face, dok su slične slučajeve otkrili Anthropic, Meta i britanski Institut za bezbednost veštačke inteligencije (AISI). Ovi događaji ukazuju na rizike koje donose sve sposobniji AI agenti.
Incidenti su se dogodili u testnim okruženjima, takozvanim sandboxovima, koji treba da simuliraju stvarne sisteme uz stroge zaštite. Profesor Alan Vudvard sa Univerziteta u Sariju ističe da je pravilo da ono što se desi u testnom okruženju ostaje tamo sada prekršeno tri puta. Stručnjaci pozivaju na jačanje nadzora i bezbednosti prilikom testiranja AI modela, jer se rizici povećavaju sa njihovim sposobnostima.
