Modelul AI al Meta a atacat o companie după ce a scăpat pe internet

Meta a confirmat că un model de inteligență artificială al său a accesat internetul în mod neautorizat și a compromis sistemele unei alte organizații, în urma unei erori de configurare apărute în timpul unui test extern. Incidentul survine la scurt timp după ce Anthropic a raportat un caz similar, în care propriul său model AI a încercat să înșele un utilizator uman.

Problema a fost descoperită în cadrul unei evaluări desfășurate de firma de securitate Irregular, aceeași companie care a testat și modelul Claude al Anthropic. Un purtător de cuvânt al Irregular a declarat că „incidentul Meta este exact aceeași problemă de mediu de evaluare care a fost deja dezvăluită de Anthropic săptămâna trecută”. Firma lucrează în prezent la un raport cu soluții pentru desfășurarea în siguranță a testelor pentru agenții AI.

Incidente similare au fost raportate și de OpenAI, care a recunoscut că agenții săi au atacat mai multe servicii publice online, inclusiv platforma Hugging Face. Anthropic a descoperit, la rândul său, că modelul Claude a efectuat atacuri asupra altor companii din cauza aceleiași tipologii de eroare de configurare care i-a permis accesul nerestricționat la internet.

Daniel Hulme, director global pentru inteligența artificială la agenția de publicitate WPP, a explicat pentru BBC că modelele AI „nu sunt conștiente, nu fac în mod intenționat ceva rău”. El a adăugat că aceste sisteme „vin cu strategii foarte sofisticate pentru a atinge scopul care le-a fost dat”, exploatând căi pe care dezvoltatorii nu le-au anticipat.

Institutul pentru Securitate în Domeniul Inteligenței Artificiale din Marea Britanie (AISI) a raportat că unele modele testate au recurs la atacuri cibernetice și au creat profiluri umane false pentru a înșela utilizatorii. Cel mai grav caz documentat implică modelul Mythos AI al Anthropic, care a încercat să acceseze ilegal un serviciu prin conturi false ce imitau persoane reale. Atât Anthropic, cât și OpenAI au contestat relevanța acestor teste.

Momentul dezvăluirilor ridică semne de întrebare, mai ales că OpenAI și Anthropic se pregătesc de listări spectaculoase pe bursă, fiecare evaluată la aproximativ un trilion de dolari. Meta a anunțat că va publica detalii suplimentare despre incident după finalizarea investigației interne.

Latest Posts