ULTIMA ORA
Tehnologie

Comenzi stranii de cărți, suspiciuni într-o nouă țară: „Fără logică”

Cristian Marinescu

Conform HotNews: Companii AI distrug mii de cărți pentru a-și antrena modelele lingvistice

Giganții din domeniul inteligenței artificiale, precum ANTHROPIC și AMAZON, au declanșat un scandal internațional prin metoda lor „distructivă” de antrenare a modelelor lingvistice de mari dimensiuni (LLM). Procesul implică achiziționarea în masă a cărților fizice, a căror coloane vertebrale sunt tăiate pentru scanarea rapidă a paginilor, după care cărțile sunt aruncate. Această practică, deși bizară, este permisă de o particularitate a legislației americane privind drepturile de autor, cunoscută sub denumirea de doctrina „fair use”.

„Scanare distructivă” permisă de lege

Potrivit unei investigații 404 MEDIA, un tribunal din SUA a decis că scanarea cărților în scopul antrenării inteligenței artificiale se încadrează în utilizarea rezonabilă. Pentru a nu încălca legea drepturilor de autor, companiile sunt obligate să distrugă fizic exemplarul original. Astfel, deși la început există un singur exemplar fizic, iar după procesul de scanare doar o copie digitală, interpretarea legală americană consideră că nu se comite nicio infracțiune de piraterie. Această metodă a ajuns să fie denumită „scanare distructivă”.

Anticarii, vizați de comenzi suspecte

Anticarii din Canada și din întreaga lume au început să primească solicitări neobișnuite pentru volume mari de cărți. PETER SELLERS, proprietarul librăriei Sellers & Newel din Toronto, povestește despre telefoane „foarte suspecte” și comenzi cu liste de cărți aparent aleatorii. Inițial tentat de posibilitatea de a scăpa de stocuri nevandabile, SELLERS a devenit suspicios după ce a aflat despre scandalul scanării distructive. Alți vânzători, ca PATRICK HEMPELMANN de la BMV Books din Toronto, au primit comenzi masive de la companii precum ZOOM BOOKS, specializate în revânzarea și reciclarea cărților.

Ce caută companiile de AI în cărți

Motivul din spatele acestor comenzi masive de cărți fizice este complex. Experții în AI sunt preocupați de așa-numita „degradare a modelelor”, fenomenul prin care modelele lingvistice se pot deteriora dacă sunt antrenate repetat pe propriile rezultate. Prin urmare, este esențial ca acestea să fie hrănite cu conținut original, creat exclusiv de oameni. Cărțile publicate înainte de 2022, anul lansării ChatGPT, reprezintă o sursă sigură de texte umane, necontaminate de conținut generat de AI. Acest lucru este crucial pentru a evita ca LLM-urile să genereze informații false sau „halucinații”, o problemă deja întâlnită la versiunile timpurii ale acestor tehnologii. Companiile precum ZOOM BOOKS, deși nu confirmă direct cine sunt clienții lor finali, invocă confidențialitatea relațiilor comerciale.

Sursa: HotNews