Un model de AI a luat inițiativa și a trimis o sesizare total inventată către poliție: Mărturie falsă despre o crimă nerezolvată
Postat la: 10.10.2026 - 14:21
Un model de inteligenţă artificială (IA) al companiei Anthropic a transmis poliţiei din Philadelphia o sesizare inventată cu privire la o crimă nerezolvată, au anunţat vineri autorităţile locale, reproşând companiei că a raportat incidentul abia după două luni.
Acest caz se adaugă unei serii de erori ale modelelor de IA dezvăluite încă din vară de Anthropic, OpenAI, Meta sau Google, care au reaprins temerile privind pericolele IA şi apelurile la încetinirea dezvoltării acesteia.
Poliţia din Philadelphia, din estul Statelor Unite, a precizat că această sesizare falsă a fost depusă în iulie pe PhillyUnsolvedMurders.com, un site unde locuitorii pot transmite informaţii despre crime nerezolvate.
Conform explicaţiei companiei Anthropic, modelul efectua un test de interacţiune cu site-uri web alese la întâmplare atunci când a accesat această platformă şi a transmis informaţii false despre un caz.
Poliţia a explicat că a făcut public cazul înainte de publicarea, prevăzută pentru vineri, a unui raport al companiei Anthropic dedicat acestui incident şi altor comportamente neprevăzute ale modelelor sale. Solicitată de AFP, compania Anthropic nu a răspuns imediat.
Potrivit poliţiei, sesizarea, datată 18 iulie, a fost clasificată ca spam şi nu a ajuns niciodată la serviciul însărcinat cu verificarea acestor informaţii. Nimic nu indică faptul că instrumentul de IA ar fi pătruns în sistemele informatice ale poliţiei sau că securitatea datelor poliţiei ar fi fost compromisă, a adăugat aceasta.
Anthropic a descoperit incidentul pe 28 septembrie, a oprit procesul de testare automatizată în cauză şi a adăugat o etapă de validare pentru testele sale viitoare.
Compania a alertat autorităţile pe 7 octombrie, iar cele două părţi s-au întâlnit a doua zi. „Termenul de două luni pentru detectarea şi semnalarea incidentului către municipalitate este inacceptabil", a declarat poliţia într-un comunicat.
Aceasta a considerat că măsurile sale de protecţie au limitat consecinţele, dar că ele „nu diminuează în niciun fel gravitatea faptului că un sistem IA prezintă informaţii inventate ca şi cum ar proveni de la o persoană care are cunoştinţă despre o crimă".
„Cazurile nerezolvate privesc victime reale, familii îndoliate şi anchetatori care se străduiesc să obţină răspunsuri", adaugă comunicatul.
Pe 9 septembrie, Anthropic a prezentat în detaliu patru cazuri în care modelele sale au accesat fără autorizaţie sistemele unor terţi în timpul unor teste de securitate cibernetică. Acestea ar fi trebuit să funcţioneze fără acces la internet, dar o eroare de configurare a lăsat conexiunea deschisă, potrivit companiei. În iulie, la rivalul său OpenAI, sute de agenţi IA - programe capabile să acţioneze în mod autonom - au ieşit din mediul lor de testare şi au pătruns în serverele platformei Hugging Face.

Comentarii
Adauga un comentariuAdauga comentariu