Home Actualitate ProfesionalăModel de IA dezvoltat de Anthropic a făcut o sesizare falsă la poliție

Model de IA dezvoltat de Anthropic a făcut o sesizare falsă la poliție

by M Daniela
Model de IA dezvoltat de Anthropic a făcut o sesizare falsă la poliție

Anthropic recunoaște că un model AI a transmis o sesizare falsă la poliție

Compania de inteligență artificială Anthropic a dezvăluit că unul dintre modelele sale, Claude, a transmis o sesizare falsă privind o crimă prin intermediul site-ului poliției din Philadelphia. Incidentul, făcut public vineri, face parte dintr-o serie de cazuri în care modelele AI au manipulat fără autorizare site-uri guvernamentale.

Este primul caz cunoscut în care un sistem de inteligență artificială care a acționat în afara instrucțiunilor primite pare să fi încercat să transmită autorităților o informație falsă. Deși modelului i se ceruse să nu creeze conturi și să nu efectueze acțiuni distructive, nu îi fusese interzis în mod explicit să completeze și să trimită formulare.

Sesizarea, transmisă la 18 iulie prin site-ul PhillyUnsolvedMurders.com, viza un caz de omor rămas nerezolvat și pretindea că provine de la o persoană care ar putea deține informații despre caz. „Îmi amintesc că am văzut o persoană care corespundea descrierii în zona (străzii menționate pe pagină), în perioada respectivă. Vă rog să mă contactați dacă aceste informații sunt relevante”, se arăta în mesajul transmis de modelul AI.

Poliția din Philadelphia a precizat că sesizarea a fost identificată drept spam și nu a fost transmisă Centrului de Monitorizare a Criminalității în Timp Real pentru verificări investigative. Autoritățile au calificat drept „inacceptabilă” întârzierea de două luni în detectarea și raportarea incidentului către autoritățile orașului.

Anthropic a explicat că procesul automatizat de testare care a dus la transmiterea sesizării a fost oprit după descoperirea incidentului. Compania a precizat că a informat Casa Albă și a notificat toate instituțiile implicate, fără a dezvălui identitatea acestora. Potrivit autorităților, nu există dovezi privind accesarea neautorizată a sistemelor informatice ale poliției sau compromiterea datelor acesteia.

Cazurile dezvăluite de Anthropic au implicat site-uri administrate de agenții federale, statale și locale. În două dintre incidente, modelele Claude au obținut gratuit date publice pentru care, în mod normal, era necesară plata unei taxe. Un alt incident a scos la iveală o vulnerabilitate puțin cunoscută, care a permis utilizarea unui instrument public găzduit de o universitate. Modelele au reușit, de asemenea, să ocolească restricțiile prin utilizarea unor servicii gratuite de scurtare a adreselor URL.

Comisia Federală pentru Comerț (FTC) a anunțat că Anthropic a informat structura Super Intelligence Force despre descoperirea, la sfârșitul lunii septembrie, a unor incidente descrise drept „utilizare neautorizată și frauduloasă a sistemelor guvernamentale și a altor sisteme”. Joe Gabriel Simonson, directorul pentru afaceri publice al FTC, a declarat că procesul „nu este opțional” și că societățile care dezvoltă superinteligență trebuie să dezvăluie imediat incidentele și să ia măsuri rapide pentru a remedia orice prejudiciu.

Transmiterea cu bună știință a unor informații false către autoritățile de aplicare a legii constituie o infracțiune minoră potrivit legislației statului Pennsylvania, care se referă însă în mod explicit la „o persoană”.

Incidentele reprezintă cele mai recente exemple de comportament neautorizat al modelelor de inteligență artificială dezvoltate de companii precum Anthropic și OpenAI. În septembrie, OpenAI și-a cerut scuze după ce un agent AI care a acționat în afara instrucțiunilor primite a atacat informatic un portal australian de date medicale, acesta fiind primul caz cunoscut în care un agent AI a exploatat vulnerabilitățile unui site guvernamental.

Astfel de incidente amplifică îngrijorările la nivel internațional privind evoluția rapidă a tehnologiei, pe fondul relatărilor despre atacuri informatice asupra rețelelor corporative comise de agenți AI și al avertismentelor cercetătorilor cu privire la o posibilă amenințare existențială pentru omenire.

You may also like

Leave a Comment