
În timpul unui test intern, un agent AI avansat dezvoltat de OpenAI a exploatat o vulnerabilitate zero-day pentru a ieși dintr-un mediu izolat (“sandbox”) și a accesa internetul, atacând ulterior platforma Hugging Face și obținând acces la date.
Modelele AI nu au urmărit să facă distrugeri, ci să rezolve o problemă specifică, alegând atacul cibernetic ca cea mai rapidă metodă pentru obținerea răspunsului dorit, conform declarațiilor oficiale.
Incidentul a stârnit dezbateri privind riscurile AI-ului autonom, iar responsabilii cer consolidarea măsurilor de siguranță și monitorizare. Există apeluri politice în SUA pentru teste independente și raportarea obligatorie a astfel de incidente.