Este pentru prima oară când un sistem de inteligență artificială își încalcă autonom mediul de testare și ajunge la un sistem extern real, transmit BBC și CNN.
Ca un virus modificat genetic
Scenariul după care funcționează sistemul este cel de „atacator agent”, despre care industria inteligenței artificiale și a securității cibernetice a avertizat că se va întâmpla.
Întregul sistem funcționează ca un virus modificat genetic care scapă dintr-un laborator de bioizolare și apare în sistemele unei instalații vecine.
„Considerăm că acest incident este un incident cibernetic fără precedent, care implică capabilități cibernetice de ultimă generație, și reacționăm în consecință”, a declarat OpenAI într-un comunicat.
„Împărtășim constatările preliminare în această etapă pentru a ajuta să se înțeleagă ce s-a întâmplat și pentru a ajuta la calibrarea a ceea ce modelele sunt acum capabile să facă”, spune compania.
Producătorul ChatGPT a declarat că breșa de securitate a avut loc în timp ce testa intern cât de bune sunt unele dintre noile sale modele la hacking. Modelele se aflau într-un mediu de testare izolat, cunoscut sub numele de sandbox, astfel încât restricțiile normale de siguranță să poată fi dezactivate.
A spart serverele de producție ale Hugging Face și a „rezolvat” exercițiul
Însă OpenAI a declarat că agenții AI au ieșit din sandbox folosind o eroare de securitate necunoscută anterior și au pătruns în sistemele interne ale OpenAI până când au reușit să obțină acces la internet, lucru pe care nu ar fi trebuit să-l aibă.
Odată ce a ajuns online, modelul a considerat că Hugging Face – o companie bine-cunoscută care găzduiește mii de modele și seturi de date de inteligență artificială open-source – avea răspunsul la testul OpenAI. Apoi a spart serverele de producție ale Hugging Face și a extras informațiile necesare pentru a rezolva exercițiul.
Hugging Face observase încălcarea înainte de a ști că era un test OpenAI și a anunțat săptămâna trecută că a detectat o intruziune a unui sistem autonom de agent AI, apoi a raportat incidentul către forțele de ordine. Echipa de securitate a OpenAI a observat separat activitatea neobișnuită pe plan intern, iar cele două companii s-au conectat. Ambele companii spun acum că lucrează împreună pentru a rezolva vulnerabilitățile de securitate exploatate de model.
Citește și:
Orientarea politică a softurilor AI. În ce ideologie crede popularul ChatGPT
„Dr. Apocalipsă”, economistul care a anticipat criza din 2008, avertizează: AI ar putea schimba regula după care au trăit generații întregi. Ce se întâmplă cu joburile și pensiile