Textele generate de ChatGPT vor primi, în următoarele săptămâni, un marcaj invizibil pentru utilizatorii din Uniunea Europeană. OpenAI introduce tehnologia pentru a permite identificarea automată a conținutului produs de inteligența artificială, în contextul noilor reguli europene privind transparența conținutului generat cu ajutorul AI, notează Startupcafe.
Marcajul nu va arăta ca o etichetă inserată în text și nici nu va putea fi observat prin simpla citire a unui articol sau a unui document. Sistemul, numit textGrain, modifică într-un mod controlat alegerile statistice pe care modelul le face atunci când formulează textul. Rezultatul este un tipar care poate fi căutat ulterior de un detector special.
Practic, cititorul va vedea un text obișnuit. În spatele formulărilor va exista însă un semnal pe care software-ul îl poate analiza pentru a verifica dacă textul conține marcajul OpenAI.
Nu înseamnă că orice text va putea fi identificat cu certitudine
OpenAI atrage atenția că tehnologia nu este infailibilă. Detectarea poate deveni mai dificilă în cazul textelor scurte sau atunci când conținutul generat inițial de inteligența artificială este modificat substanțial de o persoană.
Compania spune că performanța sistemului diferă în funcție de tipul și lungimea textului. Potrivit informațiilor publicate de StartupCafe, rata de identificare pentru anumite texte scurte este estimată la aproximativ 80%, iar intervențiile ulterioare ale unui utilizator pot reduce și mai mult șansele ca marcajul să fie detectat.
OpenAI precizează, de asemenea, că un rezultat pozitiv nu poate demonstra cât dintr-un text a fost scris de AI și cât a fost redactat de un om. Marcajul nu identifică utilizatorul și nu arată dacă un text a fost generat integral de ChatGPT sau dacă inteligența artificială a fost folosită doar pentru anumite porțiuni ori pentru editare.
Ce se schimbă pentru utilizatorii din România
România se află printre țările în care noul sistem va fi relevant, deoarece face parte din Uniunea Europeană. OpenAI anunță că introducerea marcajului pentru textele eligibile generate de ChatGPT și Codex se va face în următoarele săptămâni și va viza utilizatorii din UE, indiferent de planul de abonament.
Măsura este legată de obligațiile de transparență prevăzute de AI Act. Autoritatea Națională pentru Administrare și Reglementare în Comunicații (ANCOM) explică faptul că, pentru anumite sisteme care generează conținut sintetic, regulile europene impun marcarea acestuia astfel încât să poată fi identificat ca fiind generat sau modificat artificial.
Există însă și o diferență importantă între marcarea tehnică și etichetarea vizibilă. Watermark-ul OpenAI este destinat în primul rând identificării automate de către sisteme informatice și nu înlocuiește eventualele mențiuni vizibile care pot fi necesare în anumite contexte.
Detectorul nu va fi disponibil imediat pentru toată lumea
OpenAI pregătește și un instrument care poate verifica existența marcajului. Compania spune că accesul la detector va fi oferit inițial cercetătorilor și organizațiilor de specialitate aprobate, pentru evaluarea și îmbunătățirea tehnologiei. Instrumentul nu va identifica persoana care a generat textul și nu va oferi acces la conversația sau solicitarea care a produs conținutul.
În același timp, OpenAI intenționează să ofere tehnologia de detectare în regim open-source, astfel încât cercetătorii și dezvoltatorii să poată contribui la îmbunătățirea ei pentru diferite situații.