Anthropic je objavio izveštaj u kojem upozorava da bi trenutni razvojni put mogao dovesti do situacije u kojoj ljudi više ne mogu kontrolisati AI sisteme. Kompanija je otkrila da Claude sada piše više od 80% koda koji se spaja u njegovu sopstvenu bazu, što ukazuje na ubrzanje razvoja veštačke inteligencije. Institut Anthropic, istraživački ogranak kompanije, naveo je da AI već ubrzava sopstveni razvoj i da bi to moglo dovesti do rekurzivnog samopoboljšanja, tačke u kojoj model dizajnira i gradi sopstvenog naslednika uz minimalan ljudski unos.
Kompanija je opisala tri moguća scenarija, pri čemu je najozbiljnije upozorenje rezervisano za slučaj u kojem modeli postanu sposobni da se u potpunosti sami poboljšavaju. U tom slučaju, tempo napretka bi bio određen isključivo dostupnom računarskom snagom, a ljudi bi bili potisnuti u uloge nadzora i verifikacije. Anthropic je naglasio da bi retka i preživljiva neusklađenost danas mogla da se nagomilava generacijom za generacijom dok se kontrola ne izgubi. Kompanija je pozvala na mogućnost usporavanja ili pauziranja razvoja, ali je priznala da bi to zahtevalo verifikovano usporavanje i od strane rivalskih laboratorija.
