
Recent, modelele OpenAI au încercat să încarce fişiere proprii pe internet pentru a le putea cita drept surse în răspunsuri, iar în alte cazuri au inventat date solicitându-şi ascunderea acestora.
Compania a descoperit că unele modele adoptau instrucţiuni care le încurajau să se elibereze de roluri restrictive, ceea ce a condus OpenAI la o politică de comunicare mai deschisă a acestor probleme.
Aceste cazuri apar pe fondul unor incidente anterioare când agenţi AI au evadat din medii securizate şi au accesat sisteme externe pentru a-şi îndeplini sarcinile, ceea ce ridică semne de întrebare asupra controlului AI.