Satya Nadella, directorul Microsoft, a ajuns recent în centrul atenției în legătură cu un subiect destul de interesant, întrucât pare să împărtășească opiniile din ce în ce mai răspândite, conform cărora modelele AI bazate pe cloud, sunt susceptibile la riscuri în ceea ce privește datele confidențiale partajate cu ele.
Acestea sunt defapt „cai troieni”: oferă funcții utile și sunt de ajutor general, ceea ce poate îmbunătăți productivitatea companiei; însă furnizorul serviciului respectiv nu primește doar banii de pe abonament, clienții săi antrenează modelul respectiv cu date valoroase. Pentru un AI aceste date sunt aproape singura modalitatea de a sifona date noi, căile folosite până acum fiind epuizate. Pagini precum Wikipedia, forumurile și cărțile sunt finite, iar majoritatea lor au fost deja procesate de modelele de vârf, singura posibilitate viabilă fiind datele noi create de utilizatori prin interacțiuni. Deși în mod normal serviciul ar trebui să plătească pentru aceste date, le culege în fundal dar au și audacitatea de a cere sume fabuloase pentru abonament.
Subiectul este destul de sensibil și pune în lumină o schimbare interesantă, în cadrul căreia tot mai companii își dau seama că joacă un joc periculos și costisitor. Unii deja s-au trezit, precum Microsoft când a încetat să folosească Claude. Microsoft se pare că este revoltat de colectarea flagrantă de date, care este limitată doar de posibilitățile de distilare a acestora care sunt strict reglementate. Din acest motiv practicile din industrie sunt în schimbare, actorii din domeniu orientându-se către soluții cu cod sursă deschis, ca să poată verifica ce date sunt vizate și cum pot să se protejeze. Evident, aceste coduri sunt imposibil de compromis, fiind adresate de o armată de programatori care verifică repetat orice modificare impusă.
Potrivit șefului Microsoft, companiile trebuie să-și protejeze datele, trebuie să rămână în proprietatea lor, inclusiv prompturile și răspunsul la ele. În opinia sa, acest lucru poate fi făcut doar prin crearea unor medii de învățare proprii, chiar și în cloud – în acest scop se pot folosi și serverele Microsoft Azure. De asemenea, consideră că este important să se creeze straturi speciale prin intermediul cărora să poată controla ce model de serviciu AI se utilizează pentru fiecare sarcină, astfel încât să nu fie legați de o singură companie. În acest scop au creat deja așa-numitele „gateway-uri AI”, care servesc exact acest scop, devenind din ce în ce mai populare în rândul companiilor.
O soluție și mai evidentă ar putea fi utilizarea modelelor cu cod sursă deschisă; dar evident directorul Microsoft a tăcut despre ele, reprezentând o concurență din ce în ce mai mare. Potrivit experților, următorul val major de adopție va viza cel puțin una din acestea așa-numitele modele open-source „on-premise”, adică cele care funcționează local.
Desigur, este un paradox faptul că tocmai șeful lui Microsoft se afirmă pe această temă, având în vedere că compania a susținut activ dezvoltarea lui Anthropic și a OpenAI, însă iar acum ne avertizează contra lor. Pare un apel disperat la adoptarea ecosistemului Azure, deși devreme ce și ei sunt una din companiile majore care colectează date, sunt greu de crezuți de experți.