După ce Anthropic a declarat săptămâna trecută că unele dintre modelele sale au spart rețelele a trei companii, iar OpenAI a dezvăluit că un agent de IA a pătruns în sistemul startup-ului Hugging Face, Meta a declarat miercuri că unul dintre modelele sale de inteligență artificială a pătruns în sistemul unei alte companii în timpul testelor de securitate cibernetică, după ce o eroare a partenerului său de testare i-a acordat modelului acces neintenționat la internet.
Meta a declarat că o configurare greșită din partea companiei independente de testare Irregular a permis, din neatenție, unuia dintre modelele sale acces la internet în timpul unei evaluări, adăugând că investighează incidentul.
Modelul „a exploatat o vulnerabilitate de securitate într-un serviciu terț, într-o manieră similară cu cazurile raportate anterior în legătură cu alte companii”, a declarat Meta într-un comunicat.
Mai devreme în cursul zilei, publicația The Information, citând surse, a raportat că modelul Muse Spark 1.1 al Meta, pe care l-a promovat drept cel mai performant model al său pentru programare în lumea reală și sarcini de tip agentic, a pătruns într-o companie neidentificată și i-a modificat sistemele interne.
Un purtător de cuvânt al Irregular a declarat pentru Reuters că incidentul a reprezentat „exact aceeași problemă legată de mediul de evaluare care a fost deja dezvăluită de Anthropic săptămâna trecută” și că nu a implicat o „evadare din sandbox sau o acțiune cibernetică sofisticată”.
„În prezent nu există probleme nerezolvate. Irregular elaborează un document de referință pentru a împărtăși cele mai bune practici privind izolarea și desfășurarea în condiții de siguranță a evaluărilor cibernetice”, a declarat Irregular.
Incidentele dezvăluite de Meta și Anthropic s-au datorat unor erori care, din neatenție, au permis modelelor lor accesul la internetul deschis. Acest lucru contrastează cu cazul OpenAI, al cărui agent de IA a exploatat în mod independent o vulnerabilitate nouă pentru a ajunge pe internet în timpul testelor cibernetice.
Chiar și așa, aceste breșe evidențiază modul în care IA a amplificat amenințările la adresa securității cibernetice și dificultățile cu care se confruntă dezvoltatorii în a menține sub control capacitățile modelelor lor.