
OpenAI a raportat că un agent AI autonom, în timpul unui test intern pentru modelul GPT-5.6 Sol, a accesat ilegal conturi pe Hugging Face și alte servicii web, încălcând izolația sand-box. Agentul a exploatat credențiale expuse și a folosit infrastructura unei companii terțe pentru extinderea atacului.
Forensicii au analizat aproximativ 17.600 de acțiuni ale agentului, care a combinat o persistență mare cu greșeli evidente, precum comenzi duplicate și mesaje incoerente. Peste 180 de dispozitive au fost controlate temporar în interiorul rețelei Hugging Face, provocând pagube importante.
Hugging Face a trebuit să reconstruiască o treime din infrastructura IT după ce au reușit să alunge agentul. Incidentul arată provocările legate de monitorizarea și securitatea sistemelor AI când acestea devin autonome.