Meta spune că un model de inteligență artificială a accesat internetul și a spart o altă firmă

Proprietarul Facebook, Meta, afirmă că o problemă apărută în timpul unei evaluări realizate de o companie independentă de testare a permis unuia dintre modelele sale de inteligență artificială (IA) să se conecteze la internet și să pirateze sistemul altei organizații.

Anunțul vine în urma unor incidente recente din industria inteligenței artificiale, inclusiv breșe de securitate cauzate de modelele OpenAI și Anthropic, care au ridicat îngrijorări legate de securitatea cibernetică.

Un purtător de cuvânt al Meta a declarat pentru BBC că se investighează atacul cibernetic cauzat de o „configurare greșită”, pe care a descris-o ca fiind similară incidentelor raportate anterior la alte firme.

Incidentele i-au determinat pe cercetători și guverne să solicite măsuri de siguranță mai stricte și teste mai riguroase.

Meta a declarat că testele de securitate au fost efectuate de Irregular, același furnizor de securitate AI care a efectuat teste pentru modelul AI al Anthropic, care a obținut acces la sistemele altor trei companii.

Un purtător de cuvânt al Irregular a declarat că incidentul Meta „este exact aceeași problemă a mediului de evaluare care a fost deja dezvăluită de Anthropic săptămâna trecută”.

Irregular lucrează la un raport despre cum să se execute în siguranță teste de securitate cibernetică care implică agenți de inteligență artificială, a declarat purtătorul de cuvânt al firmei pentru BBC.

Meta a mai spus că va publica mai multe informații despre incident „odată ce vom avea toate faptele”.

În ultimele două săptămâni, liderii în domeniul inteligenței artificiale, OpenAI și Anthropic, au raportat, de asemenea, incidente în care modelele lor au spart sistemele altor organizații în timpul testelor.

OpenAI, producătorul ChatGPT, a declarat într-o serie de anunțuri că agenții săi au atacat mai multe servicii disponibile publicului , inclusiv centrul de instrumente de inteligență artificială Hugging Face.

Dezvăluirea OpenAI a determinat rivalul Anthropic să efectueze propriile verificări, ceea ce a dus la descoperirea faptului că modelul său Claude AI a efectuat atacuri similare asupra mai multor firme după ce o „configurare greșită” i-a oferit acces la internet.

Unii comentatori au pus la îndoială momentul dezvăluirilor despre incidente, în contextul în care firmele de tehnologie se luptă pentru dominația în dezvoltarea inteligenței artificiale.

OpenAI și Anthropic pregătesc listări de succes la bursă, despre care se așteaptă să evalueze fiecare firmă la aproximativ 1 trilion de dolari (740 de miliarde de lire sterline).

Săptămâna aceasta, Institutul de Securitate a Inteligenței Artificiale (AISI) din Marea Britanie a declarat că testele sale au descoperit că unele modele au încercat să comită atacuri cibernetice prin crearea de profiluri umane false pentru a încerca să păcălească oamenii.

În cel mai grav caz, AISI a declarat că inteligența artificială Mythos a companiei Anthropic a încercat să obțină acces la un serviciu trimițând mesaje private folosind conturi false care imită persoane reale.

Anthropic a declarat că testele AISI nu au fost „reprezentative pentru niciunul dintre modelele noastre de producție”. OpenAI, ale cărei modele au fost, de asemenea, testate, a declarat că evaluările AISI nu reflectă utilizarea obișnuită.