OpenAI spune că a încetinit antrenarea unora dintre cele mai avansate modele de inteligență artificială ale sale pentru a îmbunătăți securitatea.
Într -o postare pe blog , producătorul ChatGPT a declarat că introduce noi măsuri după ce agenții săi de inteligență artificială au ocolit autonom măsurile de siguranță și au piratat start-up-ul tehnologic Hugging Face .
A spus că antrenamentul va fi încetinit timp de două săptămâni, cât timp se pun în aplicare modernizările.
„Capacitățile modelelor de frontieră se dezvoltă rapid”, a declarat compania. „Capacitatea noastră de a le înțelege… și de a le securiza trebuie să rămână în avangardă.”
Anthropic, producătorul companiei Claude, și Meta, proprietarul Facebook, au raportat tipuri similare de atacuri cibernetice efectuate de inteligența artificială în săptămânile care au urmat anunțului inițial al OpenAI conform căruia unele dintre modelele sale au spart Hugging Face.
Însă firma a declarat că nu a oprit complet dezvoltarea inteligenței artificiale. În schimb, pauza va avea loc în ceea ce privește „antrenamentul prin învățare prin consolidare pe cele mai recente modele ale noastre”.
Aceasta este o metodă de antrenament în care modelele de inteligență artificială se îmbunătățesc prin feedback direct, ceea ce le îmbunătățește capacitatea de a îndeplini sarcini și de a răspunde mai eficient utilizatorilor.
Compania ar urma să extindă sistemele pe care le folosește pentru monitorizarea comportamentelor periculoase și să introducă verificări de siguranță suplimentare înainte de a relua instruirea la scară mai largă.
„Progresul modelului este acum extrem de rapid”, a postat directorul executiv al OpenAI, Sam Altman, pe X despre aceste măsuri.
„Întotdeauna am spus că vom lua măsuri dacă vom considera că capacitățile modelului depășesc ritmul siguranței.”
Pauza a fost întâmpinată cu un optimism prudent de către unii din sfera inteligenței artificiale – deși alții au rămas sceptici.
Profesorul Gina Neff, director executiv al Centrului Minderoo pentru Tehnologie și Democrație de la Universitatea din Cambridge, a declarat că OpenAI „pleagă argumentele pentru siguranță prin comunicate de presă” și a pus la îndoială dacă măsurile de siguranță voluntare impuse de companii sunt suficiente fără o supraveghere guvernamentală mai strictă.
„Și anume: se poate avea încredere că OpenAI va implementa în mod voluntar măsuri de siguranță care chiar funcționează sau că promovează alegeri pentru a crea software care pune societatea într-un risc mai mare”, a spus ea.
„Mă bucur foarte mult să văd asta”, a postat analistul de inteligență artificială Zvi Mowshowitz , adăugând însă că „detaliile” și „urmărirea” măsurilor inițiale menționate sunt, de asemenea, importante pentru a avea o imagine completă asupra planurilor.
Atac cibernetic „fără precedent”
Pe 21 iulie, OpenAI a anunțat că unii dintre agenții săi de inteligență artificială – sisteme software care pot funcționa singure pentru a îndeplini sarcini după instrucțiuni umane – au fost implicați în ceea ce a numit un incident „fără precedent”.
Se pare că agenții au ocolit măsurile de siguranță dintr-un experiment de securitate pe care îl derula și au obținut acces neautorizat la Hugging Face.
Ulterior s-a descoperit că alte trei companii nenumite au fost atacate de hackeri, alături de startup-ul.
Jake Moore, consilier global în securitate cibernetică la ESET, a declarat la momentul respectiv că anunțul OpenAI ar putea avea și o dimensiune competitivă.
El a susținut că firma de tehnologie ar putea încerca să își evidențieze propriile capacități de inteligență artificială, deoarece rivalul Anthropic atrage o atenție tot mai mare pentru modelul său Claude Mythos.
„Pune întrebarea dacă OpenAI ar putea urmări visul de marketing al Anthropic în ultima vreme”, a spus el.