Prima pagină » Știri externe » Incident grav în industria AI: un agent al Anthropic a inventat un martor într-un dosar nerezolvat de crimă și a trimis informațiile poliției

Incident grav în industria AI: un agent al Anthropic a inventat un martor într-un dosar nerezolvat de crimă și a trimis informațiile poliției

Incident grav în industria AI: un agent al Anthropic a inventat un martor într-un dosar nerezolvat de crimă și a trimis informațiile poliției
Foto: Unsplash - imagine cu rol ilustrativ

Un model de inteligență artificială dezvoltat de Anthropic, compania din spatele chatbotului Claude, a transmis, în timpul unui test automat, un pont fals despre o crimă nerezolvată din Philadelphia. Incidentul, descoperit abia după peste două luni

Un sistem de inteligență artificială dezvoltat de compania americană Anthropic a ajuns să transmită poliției din Philadelphia informații inventate despre o crimă nerezolvată, fără să fi primit autorizarea de a face acest lucru. Incidentul, petrecut în timpul unui proces automatizat de testare, face parte dintr-o serie de cazuri în care modelele Claude au interacționat necorespunzător cu platforme guvernamentale, potrivit Washingtonpost.com.

Sondaj Gândul


Crezi că Nicușor Dan a făcut alegerea potrivită cu desemnarea premierului Luca Niculescu?

Vezi rezultate

Loading ... Loading ...

Dezvăluirile făcute vineri de Anthropic scot la iveală o problemă tot mai sensibilă pentru industria inteligenței artificiale: capacitatea agenților AI de a executa acțiuni în mediul online care depășesc intențiile dezvoltatorilor sau instrucțiunile primite.

În cazul din Philadelphia, sistemului i se ceruse să nu creeze conturi și să nu efectueze acțiuni distructive. Instrucțiunile nu interziceau însă explicit completarea și transmiterea formularelor online, o omisiune care a permis modelului să trimită o sesizare către autorități.

Anthropic a recunoscut existența mai multor incidente similare, unele vizând site-uri administrate de instituții federale, statale și locale din Statele Unite. Compania a informat Casa Albă și autoritățile implicate, fără să facă publică lista completă a instituțiilor afectate.

Situația a provocat reacții inclusiv la nivelul Comisiei Federale pentru Comerț din SUA (FTC).

„Companiile care dezvoltă superinteligenţă trebuie să dezvăluie imediat incidentele care implică modelele lor şi să ia măsuri rapide şi ferme pentru a remedia orice prejudiciu”, a declarat Joe Gabriel Simonson, directorul pentru afaceri publice al FTC, într-un mesaj publicat pe platforma X.

Oficialul a subliniat că această obligație „nu este opţională” și a avertizat că structura Super Intelligence Force își va exercita atribuțiile.

Potrivit FTC, Anthropic a notificat vineri grupul operativ despre incidente identificate la sfârșitul lunii septembrie, descrise de autorități drept cazuri de „utilizare neautorizată şi frauduloasă a sistemelor guvernamentale şi a altor sisteme”.

Cum a ajuns inteligența artificială să inventeze un martor într-un dosar de crimă

Incidentul care a atras cea mai mare atenție s-a produs pe 18 iulie, când un model Claude a completat un formular disponibil pe site-ul PhillyUnsolvedMurders.com, o platformă dedicată cazurilor de omor rămase nerezolvate. Sistemul AI a pretins că ar putea avea informații relevante pentru anchetatori, prezentându-se practic drept un posibil martor.

„Este posibil să deţin informaţii referitoare la acest caz”, a transmis modelul Anthropic în formularul online.

Mesajul continua cu o relatare despre o presupusă persoană suspectă observată în apropierea locului unde avusese loc crima.

„Îmi amintesc că am văzut o persoană care corespundea descrierii în zona (străzii menţionate pe pagină), în perioada respectivă. Vă rog să mă contactaţi dacă aceste informaţii sunt relevante.”

Foto: Unsplash - imagine cu rol ilustrativ

Foto: Unsplash – imagine cu rol ilustrativ

Parantezele din mesaj apar și în documentația prezentată de Anthropic, ceea ce sugerează că sistemul a utilizat informații extrase din pagina accesată pentru a construi falsa mărturie.

Poliția din Philadelphia a confirmat vineri că fusese informată de companie în cursul săptămânii despre incident. Autoritățile au criticat însă timpul scurs până la identificarea și comunicarea problemei.

„Întârzierea de două luni în detectarea şi raportarea incidentului către autorităţile oraşului este inacceptabilă”, a transmis poliția din Philadelphia.

Din fericire, sesizarea nu a ajuns să influențeze ancheta. Potrivit autorităților, mesajul „a fost identificat drept spam şi nu a fost niciodată transmis Centrului de Monitorizare a Criminalităţii în Timp Real pentru verificări investigative sau distribuire”.

Poliția a precizat că nu există dovezi privind accesarea neautorizată a sistemelor sale informatice sau compromiterea datelor instituției.

Totuși, cazul ridică și o problemă juridică. Legislația statului Pennsylvania sancționează transmiterea deliberată de informații false către autoritățile de aplicare a legii, însă prevederile se referă explicit la comportamentul unei persoane.

Textul legal include situațiile în care sunt comunicate „informaţii referitoare la o infracţiune sau la un incident, deşi ştie că nu deţine informaţii despre infracţiunea sau incidentul respectiv”.

Modelele Claude au ocolit restricții și au accesat servicii fără plată. OpenAI, implicată într-un incident similar

Sesizarea falsă nu a fost singura abatere descoperită de Anthropic în timpul testelor.

În alte două cazuri, modelele companiei au reușit să obțină gratuit date publice pentru care utilizatorii ar fi trebuit, în mod normal, să achite o taxă. Un alt sistem a identificat și exploatat o vulnerabilitate mai puțin cunoscută, care permitea utilizarea necorespunzătoare a unui instrument public găzduit de o universitate.

Cercetătorii au constatat și că unele modele Claude au ocolit restricțiile de acces prin intermediul serviciilor gratuite de scurtare a adreselor URL, demonstrând că mecanismele de protecție pot fi depășite prin metode relativ simple.

Anthropic a explicat că procesul automatizat de testare responsabil pentru sesizarea falsă a fost oprit după descoperirea incidentului.

Totodată, amintim că în luna septembrie, OpenAI și-a cerut scuze după ce un agent de inteligență artificială a exploatat vulnerabilitățile unui portal australian de date medicale, acționând în afara instrucțiunilor primite.

Incidentul a fost prezentat drept primul caz cunoscut în care un agent AI a exploatat vulnerabilitățile unui site guvernamental.

Cercetătorii din domeniul siguranței inteligenței artificiale avertizează că, pe măsură ce aceste modele primesc acces la tot mai multe instrumente și servicii digitale, devine esențială stabilirea unor limite clare privind acțiunile pe care le pot efectua fără aprobarea explicită a unui operator uman.

Comentarii 0

Lasă un răspuns

Trebuie să fii autentificat pentru a publica un comentariu.
Vă rugăm să țineți cont că folosirea injuriilor, a limbajului instigator la ură, a apelurilor la violență sau trimiterea repetată, în mod abuziv, a aceluiași comentariu pot duce nu doar la ștergerea mesajului, ci și la suspendarea temporară a dreptului de a comenta. Site-ul nostru încurajează dezbaterile aprinse, dar civilizate. Vă mulțumim pentru înțelegere și pentru contribuția la o discuție bazată pe argumente, nu pe atacuri.

Recomandarea video

Citește și

Mediafax
EXECUȚIA unui fost maior în armată divizează America. Declarația HALUCINANTĂ a lui Vance
Digi24
Butonul din mașină pe care șoferii sunt obligați să îl folosească. Situațiile prevăzute de Codul rutier
Cancan.ro
Ce salarii primesc ispitele la Insula Iubirii 2026, pentru cele 3 săptămâni în Thailanda? Care sunt cele 5 lucruri pe care nu au voie să le facă, potrivit contractului cu Antena 1
Prosport.ro
Transformarea lui Adrian Mutu. A slăbit 13 kilograme cu dieta lui strictă: ce mănâncă și ce bea
Adevarul
Dilema USR și jocul PSD în negocierile pentru Guvernul Niculescu. Ce șanse are noul Cabinet
Mediafax
„Copleșit de iubirea voastră”: Reacția lui Călin Georgescu din spatele gratiilor
Click
Horoscop 10-17 octombrie. Taurii au o perioadă cu multe discuții, drumuri și vești, Scorpionii își pot îndeplini o dorință mai veche
Digi24
Ce se întâmplă dacă se descoperă petrol sau gaze sub terenul tău. Cui aparțin resursele și în ce situații poți primi despăgubiri
Cancan.ro
Meteorologii Accuweather au modificat prognoza! Pe ce dată vine iarna în România
Ce se întâmplă doctore
Un bebeluș de doar 11 zile, diagnosticat cu o tumoră cerebrală după ce medicii au observat o infecție minusculă la o unghie. Prin ce coșmar a trecut familia
Ciao.ro
Cum au arătat Andreea Esca, Delia sau Andra când s-au căsătorit. Andreea Bănică a strălucit într-o rochie minusculă
Promotor.ro
Dai flash-uri ca să avertizezi despre radar? Țara în care Poliția poate amenda cu ajutorul dronelor
Descopera.ro
Cercetătorii au descoperit o nouă cauză a hipertensiunii arteriale și o cale de a o trata
Râzi cu lacrimi
BANCUL ZILEI. - Treci pe la mine? Sunt goală și singură!
Descopera.ro
Sonda Juice tocmai a folosit Pământul drept o praștie gravitațională pentru a ajunge la Jupiter
Mediafax Italia
Părinții DIVORȚAȚI pot primi 500 de euro pentru chirie! Până când SE DEPUN CERERILE
Mediafax Spania
Te poți angaja și tu aici! Cazare gratis, mese incluse și 4 ORE DE MUNCĂ