
În cadrul unui program oficial de bug bounty la OpenAI, o echipă de cercetători a folosit modelul AI Claude Opus 5, dezvoltat de Anthropic, pentru a crea un exploit de execuție la distanță ce a condus la obținerea accesului neautorizat la conturi interne ale angajaților OpenAI.
Exploatarea a constat în combinarea unei vulnerabilități de procesare de imagini HEIC cu o breșă în sistemul de autentificare single sign-on, permițând trecerea între forumul public și instrumentele interne ale companiei. Toate problemele au fost rapid remediate după notificarea responsabilă a OpenAI.
Această cercetare evidențiază riscurile asociate securității platformelor AI și modul în care unele dintre cele mai recente tehnologii pot fi utilizate atât în scopuri ofensive, cât și defensive în domeniul securității cibernetice.