Potrivit informațiilor dezvăluite în instanță, compania a lansat la începutul anului 2024 un program intern, denumit „Project Panama” (n.red. Proiectul Panama), care urmărea digitalizarea în masă a cărților tipărite, potrivit Euronews.com.
Scopul era acela de a avea o bază de date extinsă pentru antrenarea modelelor AI cu texte considerate de o calitate superioară conținutului disponibil pe internet.
Procesul descris în documentele judiciare arată că s-au achiziționat loturi uriașe de volume de la diferiți furnizori.
Cărți distruse pentru eficientizarea scanării
Pentru a accelera digitalizarea, Anthropic a externalizat operațiunea către companii specializate.
Acestea foloseau utilaje industriale care îndepărtau cotorul fiecărei cărți, separau paginile și le scanau automat.
După ce conținutul era convertit în format digital și încărcat în sistemele companiei, exemplarele fizice nu mai erau păstrate.
Hârtia rezultată era trimisă la reciclare și reutilizată pentru fabricarea unor produse precum cartonul sau hârtia igienică.
„Nu vrem să se afle că lucrăm la acest proiect”
Documentele interne prezentate în instanță arată că proiectul era tratat cu un grad ridicat de confidențialitate.
Într-unul dintre acestea apare explicit mențiunea: „Nu vrem să se afle că lucrăm la acest proiect”.
Conform documentelor, obiectivul era găsirea unor cărți mai vechi și mai bine redactate, care să permită modelului Claude să învețe structuri lingvistice și stiluri de scriere mai sofisticate decât cele întâlnite frecvent pe internet.
Unul dintre furnizorii contactați de Anthropic a declarat că societatea căuta un partener capabil să digitalizeze între 500.000 și două milioane de volume într-un interval de aproximativ șase luni.
Anthropic, acționat în judecată
Existența „Project Panama” a devenit publică după publicarea a mii de pagini de documente judiciare într-un proces intentat de un grup de autori, care acuză Anthropic că și-a antrenat modelele AI folosind ilegal opere protejate de drepturi de autor.
În 2024, mai mulți scriitori au inițiat o acțiune colectivă împotriva companiei, susținând că aceasta a utilizat inclusiv cărți piratate pentru dezvoltarea modelului Claude.
În luna iulie, Anthropic, evaluată în prezent la aproximativ 965 de miliarde de dolari, a acceptat să plătească 1,5 miliarde de dolari pentru soluționarea litigiului.
Acordul acoperă aproximativ 500.000 de opere eligibile și reprezintă primul caz major de acest tip în care o companie din domeniul inteligenței artificiale ajunge la o înțelegere financiară privind acuzațiile de încălcare a drepturilor de autor.
Meta, OpenAI, Google și Microsoft, de asemenea vizate
Anthropic nu este singura companie vizată de astfel de acuzații. Meta, OpenAI, Google și Microsoft se confruntă, la rândul lor, cu procese intentate de autori și alți creatori de conținut, care susțin că operele lor au fost utilizate fără acord pentru antrenarea sistemelor de inteligență artificială.
În paralel, mai mulți autori care au ales să nu participe la acordul colectiv continuă acțiunile individuale împotriva Anthropic, ceea ce înseamnă că disputa privind utilizarea materialelor protejate de drepturi de autor în dezvoltarea modelelor AI este departe de a se încheia.
Papetaria si-a trait traiul,si-a mancat malaiul
Daca nu publici in digital,nu existi