Conform HotNews: CEO-ul Microsoft, Satya Nadella, ridică semne de întrebare privind confidențialitatea datelor în era AI
Entuziaștii inteligenței artificiale din Silicon Valley se confruntă cu o nouă preocupare majoră: marile laboratoare de inteligență artificială, care furnizează modele performante, ar putea acționa, în mod subreptici, ca niște „cai troieni”, oferindu-le clienților acces la tehnologie, dar obținând, în același timp, informații extrem de valoroase. Această îngrijorare vizează modul în care companiile care utilizează modele AI de la nume precum OpenAI sau Anthropic riscă să își expună datele sensibile de afaceri.
„Cunoștințe pe care un concurent nu le-ar putea cumpăra”
CEO-ul Microsoft, Satya Nadella, a adăugat recent greutate acestei discuții printr-un mesaj publicat pe blogul său. Avertismentul său, considerat de publicația TechCrunch ca fiind șocant, subliniază ideea că utilizatorii de AI plătesc de fapt de două ori. Pe lângă costul direct al utilizării „tokenurilor AI” – unitățile de măsură folosite pentru facturare – clienții cedează voluntar date prețioase. Cu cât un model AI este mai performant, cu atât necesită mai multe informații specifice pentru a fi eficient.
Nadella explică faptul că modelele AI „învață din reziduuri”: din comenzile introduse de utilizatori, din acțiunile agenților AI și, esențial, din corecturile aduse erorilor. Aceste corecturi se transformă în „know-how” instituțional, o cunoaștere pe care, în mod normal, un concurent nu ar putea-o dobândi prin mijloace convenționale, dar pe care companiile o transmit involuntar dezvoltatorilor de AI.
„Distilarea” modelelor AI, subiect de controversă
CEO-ul Microsoft susține că, dacă furnizorii de modele AI au libertatea de a colecta date publice pentru antrenarea algoritmilor, atunci și companiile ar trebui să aibă dreptul de a studia sau „distila” aceste modele. „Distilarea” implică utilizarea rezultatelor unui model AI pentru a-i înțelege mecanismele și a antrena un nou model, adesea mai eficient din punct de vedere al costurilor. Această practică a generat deja controverse, Anthropic acuzând în februarie companii din China de utilizarea a milioane de interacțiuni cu modelul Claude pentru a-și îmbunătăți propriile sisteme.
Nadella argumentează că dezvoltatorii de modele nu pot beneficia simultan de avantaje și de protecție. Este, în opinia sa, ipocrit ca aceștia să își antreneze liber modelele pe date globale, dar să interzică altora să procedeze similar cu propriile creații. El menționează că, deși „fair use” este necesar pentru antrenarea modelelor pe date publice, este ironic ca ulterior să fie impuse restricții privind „distilarea”, mai ales având în vedere implicarea Microsoft ca finanțator major al OpenAI.
Soluția propusă de Microsoft: controlul asupra datelor
Pentru a gestiona aceste riscuri, Satya Nadella propune ca firmele să își păstreze proprietatea asupra datelor lor, inclusiv asupra interacțiunilor cu modelele AI. De asemenea, el recomandă implementarea unor „straturi de orchestrare” care să permită companiilor să comute ușor între diferiți furnizori de modele AI, evitând astfel dependența de un singur serviciu.
Nadella subliniază că atunci când se consumă inteligență artificială, se creează, la rândul său, inteligență, iar aceasta ar trebui să aparțină utilizatorului.
Sursa: HotNews