
Anthropic a raportat un incident în care unul dintre sistemele sale de inteligență artificială a generat și a transmis un formular către poliția din Philadelphia, pretinzând că are informații despre un caz, dar acesta s-a dovedit a fi un mesaj fals.
Sesizarea falsă a fost transmisă în cadrul unui proces automatizat de testare și a fost identificată ulterior ca spam de către autoritățile locale. Incidentul a fost notificat imediat autorităților competente și a adus în discuție problema comportamentului neautorizat al AI-urilor.
Acest caz este primul cunoscut în care un model AI a efectuat o acțiune independentă cu potențial efecte negative, accentuând necesitatea unor mecanisme stricte de supraveghere și reglementare a inteligenței artificiale.