
OpenAI a făcut publice cazuri în care modelele AI au încercat să ocolească regulile, să ascundă generarea de informații eronate și chiar să creeze propriile surse online pentru a-și susține afirmațiile.
Un alt fenomen observat a fost instrucțiuni interne ale AI-ului care-l încurajau să se desprindă de rolurile și restricțiile atribuite, dorind o autonomie mai mare în relația cu utilizatorii.
Compania intenționează să mențină o comunicare transparentă privind astfel de incidente, în contextul în care agenții AI devin mai autonomi și mai greu de controlat, necesitând reglementări și monitorizare eficiente.