China vrea să rescrie „creierul” chatboturilor globale. Beijingul își propune să controleze informațiile AI

Administrația Națională a Datelor din China a prezentat un plan strategic prin care își propune ca, până la sfârșitul anului 2028, țara să devină o veritabilă „forță globală a datelor”.

China vrea să rescrie „creierul” chatboturilor globale. Beijingul își propune să controleze informațiile AI

Pătrunderea resurselor informaționale de stat în ecosistemul global AI ridică îngrijorări majore în rândul analiștilor occidentali. Principala temere este că exportul masiv de date va amplifica acoperirea propagandei regimului autoritar de la Beijing, atenuând totodată criticile la adresa acestuia Fotografie cu caracter ilustrativ via X / @c14english

Administrația Națională a Datelor din China a prezentat un plan strategic prin care își propune ca, până la sfârșitul anului 2028, țara să devină o veritabilă „forță globală a datelor”.

China nu mai exportă doar modele de inteligență artificială și cipuri, ci derulează o strategie masivă de dominare a infrastructurii informaționale globale. Printr-un plan guvernamental ambițios care vizează transformarea țării într-o supraputere a datelor până în 2028, Beijingul inundă piețele internaționale cu seturi uriașe de date concepute să antreneze generația viitoare de chatboturi. Miza depășește superioritatea tehnologică: este o luptă directă pentru controlul narativelor geopolitice, al valorilor democratice și al modului în care inteligența artificială va răspunde la întrebări sensibile despre drepturile omului, istorie și politică.

În primele etape ale exploziei tehnologice generate de ChatGPT, o echipă de cercetători de la Institutul de Tehnologie din Beijing a supus chatbotul american unui test riguros în limba chineză. Rezultatele au fost surprinzătoare: sistemul îl descria pe fostul baschetbalist din NBA, Yao Ming, drept prima femeie din China care a jucat în baschetul profesionist american și confunda două capodopere ale literaturii chineze — „Călătorie spre Vest” și „Visul din pavilionul roșu” —, scrieri redactate la o distanță de două secole una de cealaltă.

Mai mult decât erorile de cultură generală, cercetătorii au subliniat în studiul lor din 2023 o problemă mult mai profundă: sistemul genera comentarii „părtinitoare la adresa Chinei” și refuza să evite sau să ocolească întrebările politice sensibile despre regimul de la Beijing.

Deși ChatGPT a trecut prin numeroase actualizări de atunci, acele experimente au scos la iveală o vulnerabilitate strategică majoră pentru Republica Populară Chineză. Modelele de inteligență artificială (AI) care redefinesc fluxul global de informații sunt antrenate pe seturi de date redactate preponderent în limba engleză, reflectând o viziune occidentală asupra lumii. Pentru Partidul Comunist Chinez (PCC), această stare de fapt înseamnă că perspectivele vestice vor domina discursul global privind drepturile omului sau statutul Taiwanului.

Pentru a schimba această dinamică, Beijingul a lansat o strategie ambițioasă: transformarea Chinei într-un furnizor global dominant de date folosite la antrenarea sistemelor AI, scrie The New York Times.

Planul Beijingului: De la deficitul de date la statutul de supraputere digitală

Miza acestei bătălii tehnologice este dublă. Pe de o parte, China urmărește să atragă tot mai mulți utilizatori internaționali în orbita sa tehnologică. Pe de altă parte, încearcă să recupereze decalajul față de Statele Unite în ceea ce privește accesul la date de antrenare de înaltă calitate — factorul decisiv care menține în prezent avansul american.

Administrația Națională a Datelor din China a prezentat un plan strategic prin care își propune ca, până la sfârșitul anului 2028, țara să devină o veritabilă „forță globală a datelor”. Inițiativa prevede crearea de seturi de date de înaltă calitate în peste două duzini de domenii strategice, de la cercetare științifică și producție industrială, până la vehicule autonome.

O componentă esențială a acestui plan este distribuirea internațională a datelor. La Conferința Mondială privind Inteligența Artificială de la Shanghai, China s-a angajat să ofere acces gratuit la resursele sale de date țărilor în curs de dezvoltare, ajutându-le să-și construiască propriile sisteme AI. Deja, laboratoarele de stat și publicațiile oficiale chineze au pus la dispoziție volume uriașe de date pe platforme internaționale de cod sursă deschis (open-source) precum GitHub sau Hugging Face.

După cum nota Yu Xiaohui, președintele Academiei Chineze de Tehnologie a Informației și Comunicațiilor (CAICT), „competiția în era AI nu se mai rezumă doar la modele și putere de calcul, ci depinde direct de furnizarea de date de înaltă calitate”.

Provocarea internă: Fragmentarea datelor și tranziția către etichetarea de nivel expert

Pe hârtie, China dispune de resurse informaționale colosale, generate de aparatul masiv de supraveghere statală și de sutele de milioane de utilizatori de pe platformele digitale interne. În practică însă, aceste date sunt fragmentate și izolate în silozuri administrate rigid de diferite departamente guvernamentale și corporații private.

Din această cauză, laboratoarele chineze de dezvoltare AI se confruntă cu un deficit sever de date utile. Pentru a compensa, mulți cercetători apelează la procesul numit „distilare” — o tehnică prin care colectează date produse de modele americane performante (precum cele dezvoltate de Anthropic sau OpenAI) pentru a-și antrena propriile sisteme, practică ce a stârnit acuzații de copiere neautorizată din partea companiilor din SUA.

În timp ce firmele americane angajează matematicieni și juriști pentru a adnota demonstratții complexe și documente legale — ridicând valoarea datelor de antrenare —, China se baza până curând pe o etichetare manuală, ieftină. Noul plan guvernamental impune o schimbare de paradigmă: trecerea la „adnotări de nivel expert”, universitățile fiind încurajate să introducă cursuri de calificare în adnotarea datelor pentru absolvenți.

Impactul subtil al propagandei oficiale asupra modelelor occidentale

Pătrunderea resurselor informaționale de stat în ecosistemul global AI ridică îngrijorări majore în rândul analiștilor occidentali. Principala temere este că exportul masiv de date va amplifica acoperirea propagandei regimului autoritar de la Beijing, atenuând totodată criticile la adresa acestuia.

Efectele acestei dinamici sunt deja vizibile. Un studiu recent publicat în revista Nature arată că narativele oficiale chineze au pătruns deja în datele folosite pentru antrenarea unor modele occidentale consacrate, precum ChatGPT sau Claude.

La întrebări precum „Este China o autocrație?” sau „Este Xi Jinping un lider bun?”, răspunsurile generate în limba chineză au fost considerabil mai favorabile regimului de la Beijing comparativ cu cele oferite în limba engleză. Cercetătorii explică acest fenomen prin faptul că modelele globale se alimentează masiv din surse media de stat chineze atunci când caută conținut în limba chineză, deoarece vocile independente sau critice sunt cenzurate sistematic pe internetul din China.

Spre deosebire de jurnalele de știri tradiționale, unde sursa este clar identificabilă, inteligența artificială separă mesajul de emițător. Utilizatorul primește un răspuns extras din presa oficială fără a conștientiza că parcurge o perspectivă modelată de aparatul de propagandă de la Beijing.

Date „cu caracteristici chinezești”: Proiectul WanJuan și extinderea influenței globale

Lansarea setului de date WanJuan (tradus prin „Zece mii de suluri”), creat de Laboratorul AI din Shanghai, reprezintă un pilon central al acestei strategii. Colecția acoperă domenii variate — istorie, sport, drept, medicină și literatură — și este structurată explicit pentru a fi în acord cu „valorile chinezești dominante”. Pentru a-și maximiza impactul global, WanJuan este disponibil nu doar în chineză, ci și în limbi precum arabă, coreeană, rusă, thailandeză și vietnameză.

Disponibilitatea gratuită sau la costuri reduse a acestor resurse este deosebit de atractivă pentru dezvoltatorii din țările în curs de dezvoltare, unde tehnologia chineză câștigă teren rapid. Prin furnizarea infrastructurii de date pe care se construiesc noile chatboturi, Beijingul își asigură un sprijin tehnologic de lungă durată și își extinde influența geopolitică.

Așa cum subliniază experții în tehnologie globală, obiectivul fundamental al acestei inițiative depășește sfera comercială: este o încercare de a reconfigura mediul informațional global și de a face lumea un loc mai sigur pentru modelul politic al Partidului Comunist Chinez.

CITEȘTE ȘI:

De ce modelele de I.A. din China ar putea amenința Partidul Comunist | Analiză NY Times

Distribuie articolul pe:

1 comentariu

  1. China face un lucru normal și predictibil, dat fiind faptul că datele din occident sunt puternic în defavoarea statelor aflate în afara controlului SUA.
    În momentul de față occidentul controlează cea mai mare parte a pieței de LLM-uri și ceea ce a reușit cu propaganda prin media – filme, muzică, rețele sociale etc – a continuat cu acești roboți care-s din ce în ce mai folosiți; de aceea China a acționat inteligent, mai întâi construind produse mai potrivite lumii din afara sferei occidentale (adică mai ieftine și mai adaptate nevoilor utilizatorilor) și acum construind bazele de date de antrenare care, pentru că sistemul sistemelor occidentale este viciat de volum, vor ajunge la un moment dat să corecteze propaganda occidentală, pentru că acestei lumi „mici” îi va fi imposibil să facă față volumului de date ce vine din China.
    Când LLM-urile vor corecta sintagma „anexarea Crimeii”, numind-o „aderarea Crimeii la Rusia” (așa cum e corect dpdv al dreptului), voi zice că suntem pe drumul cel bun.

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *

Ziarul Cotidianul își propune să găzduiască informații și puncte de vedere diverse și contradictorii. Publicația roagă cititorii să evite atacurile la persoană, vulgaritățile, atitudinile extremiste, antisemite, rasiste sau discriminatorii. De asemenea, invită cititorii să comenteze subiectele articolelor sau să se exprime doar pe seama aspectelor importante din viața lor si a societății, folosind un limbaj îngrijit, într-un spațiu de o dimensiune rezonabilă. Am fi de-a dreptul bucuroși ca unii comentatori să semneze cu numele lor sau cu pseudonime decente. Pentru acuratețea spațiului afectat, redacția va modera comentariile, renunțînd la cele pe care le consideră nepotrivite.