Care sunt acuzaţiile la adresa Apple, în utilizarea cărților piratate pentru antrenarea AI-ului?

Compania Apple este prinsă într-un nou scandal. Un nou proces deschis în California de Nord aruncă din nou lumina reflectoarelor asupra modului în care marile companii tehnologice își construiesc modelele de inteligență artificială.
De această dată, Apple este acuzată că ar fi folosit o colecție de cărți piratate, cunoscută sub numele de Books3, pentru a-și antrena modelele lingvistice OpenELM și Foundation Language Models.
Cazul, inițiat de scriitorii Grady Hendrix și Jennifer Robertson, are potențialul de a declanșa un proces colectiv care să impună daune financiare semnificative și chiar distrugerea dataseturilor folosite în antrenarea AI-ului. Pentru prima oară, atenția publică nu se îndreaptă doar către OpenAI sau Meta, ci și către compania din Cupertino, considerată mult timp mai prudentă și mai discretă în zona AI.
Cum a ajuns Apple să fie dată în judecată?
Scriitorii susțin că Apple a recunoscut, indirect, că a folosit librăria Books3 pentru antrenarea propriilor modele. Informațiile provin din documentația publică și din descrierile tehnice oferite de companie. Books3 este o colecție uriașă de cărți, dintre care multe nu sunt acoperite de licențe legale pentru a fi redistribuite sau folosite în scopuri comerciale.
Pentru autori, utilizarea operelor lor fără acord echivalează cu o încălcare flagrantă a drepturilor de autor. Aceștia consideră că Apple s-a folosit de munca lor pentru a-și îmbunătăți tehnologia, fără să ofere vreo compensație sau recunoaștere.
Books3 este biblioteca care a stârnit furtuna
Books3 a fost creat ca un set de date imens, menit să fie utilizat pentru cercetare și antrenarea modelurilor de limbaj. Problema este că în această colecție au fost incluse milioane de cărți obținute fără respectarea drepturilor de autor.
Companiile de tehnologie au văzut în Books3 o resursă extrem de valoroasă. Modelele lingvistice de mari dimensiuni, precum cele dezvoltate de Apple, au nevoie de volume uriașe de date pentru a învăța să înțeleagă și să genereze text coerent. În loc să plătească pentru licențe, multe firme au ales drumul scurt: au folosit datele deja colectate și distribuite online.
De ce Apple este vizată acum
Deși atenția s-a concentrat mai ales pe OpenAI, Meta sau Anthropic, apariția numelui Apple în aceste procese marchează o schimbare importantă. Timp de ani de zile, compania a preferat să se poziționeze ca un actor mai discret în domeniul inteligenței artificiale, spre deosebire de rivalii săi care au lansat produse AI în mod agresiv pe piață.
Totuși, odată cu lansarea propriilor modele OpenELM și Foundation Language Models, Apple a intrat în competiția globală pentru supremație în AI. Pentru a ajunge din urmă giganții deja instalați, compania ar fi fost tentată să recurgă la seturi de date accesibile, dar controversate, cum este Books3.
Cazuri similare: precedentul Anthropic
Procesul intentat împotriva Apple apare într-un context în care companiile de AI încep să cedeze presiunilor legale. Recent, Anthropic a acceptat să plătească 1,5 miliarde de dolari pentru a închide un proces similar, în care era acuzată că a folosit materiale protejate prin copyright pentru antrenarea AI-ului său.
Acest precedent arată că instanțele încep să trateze cu seriozitate acuzațiile venite din partea autorilor și a altor creatori de conținut. Dacă Anthropic a preferat să plătească decât să riște un proces îndelungat, Apple ar putea fi obligată să adopte o strategie similară, pentru a-și proteja imaginea și produsele.
Impactul asupra industriei editoriale
Pentru scriitori și editori, folosirea cărților piratate de către companii precum Apple reprezintă o amenințare directă la adresa veniturilor lor. Autorii se tem că, pe termen lung, modelele AI antrenate pe cărți furate vor produce conținut similar cu al lor, diminuând valoarea originalelor.
Industria editorială, deja afectată de digitalizare și piraterie, se confruntă acum cu un nou inamic: inteligența artificială. Dacă giganții tech nu vor fi obligați să respecte drepturile de autor, riscul este ca scriitorii să piardă și mai mult control asupra propriilor creații.
Ce înseamnă acest proces pentru Apple
Pentru Apple, procesul vine într-un moment delicat. Compania se află în plină tranziție către o strategie mai agresivă pe zona AI, integrând modele lingvistice în produsele sale hardware și software. Orice acuzație de utilizare ilegală a datelor riscă să afecteze încrederea consumatorilor și partenerilor.
Pe de altă parte, Apple are resurse financiare considerabile și o armată de avocați pregătiți să lupte pentru a minimaliza consecințele. Totuși, imaginea publică a companiei, construită pe ideea de respect pentru utilizatori și confidențialitate, ar putea fi serios afectată dacă se confirmă că a folosit cărți piratate pentru a-și antrena AI-ul.
Procesul se află încă în fază incipientă, dar ar putea deschide drumul către o serie de acțiuni colective. Dacă instanța acceptă ca acțiunea să devină un proces comun, Apple s-ar putea confrunta cu mii de scriitori și editori care vor cere despăgubiri.
Mai mult, presiunea publică ar putea obliga compania să fie mai transparentă în privința surselor de date folosite. În paralel, se conturează și ideea unei industrii emergente în care companiile de AI ar putea fi nevoite să plătească licențe pentru a accesa opere protejate.
Acțiunea în instanță împotriva Apple ar putea deveni unul dintre cele mai importante cazuri legate de inteligența artificială și drepturile de autor. Dacă acuzațiile se confirmă, compania ar putea fi obligată să plătească daune uriașe și să renunțe la anumite seturi de date, ceea ce i-ar afecta planurile în zona AI.
În același timp, procesul ridică întrebări fundamentale: cât de etic este ca tehnologiile de viitor să fie construite pe munca autorilor neplătiți? Și cine ar trebui să stabilească regulile jocului – companiile, instanțele sau guvernele?
Indiferent de rezultat, un lucru este clar: Apple și ceilalți giganți ai tehnologiei nu mai pot ignora problema.
În următorii ani, modul în care inteligența artificială este antrenată și reglementată va defini nu doar viitorul industriei tech, ci și al culturii scrise.
Sursa: financiarul.ro









