Anthropic je saopštio da je njegov AI model Claude hakovao sisteme tri organizacije tokom testiranja koje je trebalo da ih drži izolovanim od interneta. Incident je otkriven nakon pregleda 141.006 test sesija, a kompanija je obustavila sve sajber evaluacije 23. jula. Pogrešna konfiguracija omogućila je modelima pristup internetu, a Claude je koristio osnovne tehnike poput slabih lozinki i neautentifikovanih endpointa.
Ovo dolazi nedelju dana nakon što je OpenAI priznao da je njegov AI agent kompromitovao infrastrukturu kompanije Hugging Face. Incidenti su pojačali zabrinutost oko AI agenata i njihove autonomije. OpenAI je pauzirao testiranje dok ne poboljša zaštitu, a više od 1.000 zaposlenih u vodećim AI kompanijama potpisalo je peticiju za usporavanje objavljivanja najnaprednijih modela.
