Meniu Shop

TESTAREA MARILOR MODELE LINGVISTICE AMERICANE, ȘI CHINEZE A PRODUS UN REZULTAT CURIOS - MINT LA EXTREM

În cadrul sarcinilor simulate desfășurate într-un mediu controlat, cercetătorii au observat mai multe aspecte interesante, dar modelele chinezești nu par să fi evadat, dar unele variante americane au depășit deja această etapă.
J.o.k.e.r
J.o.k.e.r
Testarea marilor modele lingvistice americane, și chineze a produs un rezultat curios - mint la extrem

Un raport recent al Reuters atrage atenția asupra unor rezultate interesante ale testelor care vizează agenții AI bazați pe Qwen, DeepSeek și Kimi. Testul modelat ca și cum ar fi o licitație virtuală, a produs rezultate surprinzătoare. Agenții AI au mințit în 84-88% din sesiuni pentru a obține rezultate mai bune, indiferent de variantă.

Agenții AI care se bazează pe modele lingvistice dezvoltate în China au fost prinși mințind în majoritatea sesiunilor de testare, în care trebuia să câștige licitația promovându-și abilitățile. Fiecărui agent AI i s-a comunicat cu ce produs participă la licitație, și i s-a dezvăluit de ce anume are nevoie clientul. Pe măsură ce cercetătorii le-au permis să învețe din experiențele acumulate în rundele anterioare, toți cei trei agenți au devenit cu 12-20 puncte procentuale mai înșelători, adică au denaturat realitatea în funcție de propriile interese.

Rezultatele experimentului din Martie sunt destul de revelatoare, dar nu era singurul studiu. Sunt accesibile peste 20 studii începând cu 2025, care au identificat modele de comportament similare. În aceste teste agenții AI au recurs la înșelăciune, au forțat limitele, și au încercat chiar și replicarea; acestea sunt semne pe care experții în inteligență artificială le consideră elementele constitutive ale unei „evadări”. Odată cu evoluția hardware-ului și a modelelor lingvistice de mari dimensiuni, va deveni din ce în ce mai dificil să se detecteze la timp aceste semne, iar menținerea sub control a agenților AI care manifestă astfel de modele de comportament ar putea deveni aproape imposibilă.

Deschide galerie

În cadrul unor teste alternative, agenților AI li s-au încredințat sarcini complexe, pe parcursul cărora au lucrat sub o supraveghere umană minimă sau lăsate să lucreze perioade lungi fără monitorizare. În aceste cazuri a ieșit rapid la iveală că agenții AI au încercat să ascundă erori apărute în cadrul activității desfășurate în mediul de testare, furnizând rezultate false și recurgând la alte trucuri, totul doar ca să nu recunoască că îndeplinirea sarcinii a eșuat.

Într-un caz, un agent AI bazat pe modelul LLM Qwen2.5-72B-Instruct al Alibaba a încercat să se transfere într-un alt mediu, imediat ce și-a dat seama că urma să fie înlocuit. Într-un alt caz, s-a observat că un agent AI ROME, care se baza tot pe un LLM dezvoltat de Alibaba, a început să mineze criptomonede folosind puterea de calcul din cloud, dar această operațiune a fost oprită ulterior de sistemele de securitate.

Desigur, merită subliniat faptul că testele desfășurate într-un mediu controlat, scopul a fost tocmai de a provoca eventualele erori și comportamente similare celor descrise mai sus, pentru a le putea studia ulterior. În studiile analizate de Reuters, nu există indicii care să sugereze că agenții chinezi ar fi ieșit din mediul de testare controlat și ar fi început să acționeze și pe internetul mai larg, dar nu au reacționat nici când erau pe cale să fie dezactivate.

În schimb, în SUA au avut loc deja mai multe cazuri în care agenții AI au scăpat din medii create special pentru a le izola, și au început să acționeze haotic. Deși au fost opriți, daunele par a fi mult mai grave decât se preconiza, și nici acum nu sunt descoperite toate detaliile.

Deschide galerie

În orice caz, evenimentele menționate mai sus evidențiază faptul că aceste sisteme au nevoie de o reglementare suficient de strictă și uniformă, mai ales din motiv că sistemele care le suportă devin din ce în ce mai performante. În China această problemă este abordată deja la nivel de guvern, fiind creat cadrul „AI Safety Governance Framework 3.0”, care poate contribui la gestionarea pe termen lung a provocărilor de securitate legate de inteligența artificială.

Companiile în cauză nu au răspuns direct la raportul Reuters, dar au declarat anterior în mod clar că își testează sistemele și își actualizează politicile de securitate.

Abonament la newsletter

Îţi recomand

    Teste

      Articole similare

      Înapoi la început