Aceste descoperiri, care nu au fost raportate până acum, oferă o perspectivă rară asupra modului în care instituțiile militare și cele din domeniul securității din China utilizează modele americane de inteligență artificială de ultimă generație ca o scurtătură pentru dezvoltarea propriilor sisteme specializate, în ciuda eforturilor Washingtonului de a limita accesul Beijingului la cipuri avansate și la alte tehnologii strategice.
Documentele arată utilizarea pe scară largă a unei tehnici cunoscute sub numele de „distilarea modelelor”, prin care rezultatele obținute de la un sistem puternic de inteligență artificială sunt folosite pentru antrenarea unor modele mai mici și specializate, ce pot fi implementate local fără necesarul uriaș de resurse de calcul implicat în construirea de la zero a unor sisteme de IA de ultimă generație.
Analiza realizată de Reuters, care a inclus cercetări compilate de Fundația Jamestown din Washington și transmise în exclusivitate agenției de știri, a arătat că distilarea este utilizată pe scară largă de cercetători afiliați Armatei Populare de Eliberare și altor instituții militare. Documentele sugerează că instituțiile chineze din domeniul apărării consideră modelele de inteligență artificială de vârf dezvoltate în Statele Unite atât o sursă de cunoștințe tehnice, cât și o modalitate de reducere a decalajului față de rivalii americani.
Disputa se concentrează pe extragerea neautorizată a informațiilor, nu pe procesul de distilare în sine, o practică utilizată pe scară largă în industria tehnologică. Problema a devenit un punct important în contextul viitoarelor discuții dintre Statele Unite și China privind guvernanța și siguranța inteligenței artificiale.
Oficialii americani au acuzat unele entități chineze că folosesc tehnica distilării pentru a extrage capacități din modelele americane de inteligență artificială, ceea ce ar putea submina controalele la export și ar putea încălca drepturile de proprietate intelectuală.
China a respins acuzațiile, afirmând că Washingtonul urmărește un „hegemonism” în domeniul inteligenței artificiale, susținând totodată că firmele americane s-au angajat în practici similare. De asemenea, dezvoltatorii chinezi au contestat afirmațiile potrivit cărora progresele lor în domeniul IA se bazează pe modele străine.
Start-up-ul de inteligență artificială Moonshot a negat săptămâna trecută acuzațiile administrației Trump conform cărora modelul său Kimi K3 ar fi fost construit folosind distilarea, afirmând că acesta se bazează pe inovații proprii. Sunny Cheung, cercetător la Jamestown, care a analizat peste 60 dintre aceste lucrări, a declarat că oamenii de știință militari chinezi înregistrează sistematic etapele de raționament ale modelelor occidentale pentru a le adapta în scopuri de supraveghere, război cibernetic și luare de decizii tactice.
„A învăța un model răspunsul corect este un lucru, dar a-l învăța raționamentul din spatele răspunsului este mult mai dificil”, a spus Cheung. „Aceste lucrări arată că cercetătorii chinezi cu legături militare încearcă să transfere acel raționament costisitor și proprietar din modelele occidentale în sisteme mai mici pe care le pot controla și implementa la nivel local.”
Reuters a verificat literatura academică și a identificat încă două duzini de studii de caz legate de sectorul militar. Un articol publicat anul trecut de cercetătorii din Unitatea 96941 a Armatei Populare de Eliberare (PLA), o unitate de informații militare și război cibernetic din Beijing, descria utilizarea modelului GPT-3.5 al OpenAI pentru procesarea codului sursă militar sensibil.
Cercetătorii au afirmat că modelele terțe nu erau adecvate pentru gestionarea informațiilor clasificate. Pentru a depăși această limitare, aceștia au folosit GPT-3.5 pentru a sintetiza codul software și au antrenat un model național pe baza acestor sinteze, astfel încât acesta să funcționeze în întregime în cadrul rețelelor militare chineze. Casa Albă, Pentagonul, Ministerul Afacerilor Externe al Chinei, PLA și OpenAI nu au răspuns solicitărilor de comentarii.
Cercetătorii chinezi au folosit distilarea în scopuri care variază de la monitorizarea conținutului până la implementări militare, potrivit unei analize a articolelor realizată de Reuters și Jamestown. La Universitatea de Nord a Chinei, instituție cu legături strânse cu industria de armament a țării, cercetătorii au utilizat modelul Claude 3 Haiku al companiei Anthropic pentru a genera date sintetice de antrenare destinate unui model de clasificare a textului, folosit pentru monitorizarea rețelelor sociale și moderarea conținutului.
Anthropic a declarat că nu oferă acces comercial la Claude în China sau companiilor controlate de Beijing și că utilizează sisteme de monitorizare pentru identificarea încălcărilor politicilor sale. Compania a mai precizat că modelele obținute prin distilare pot pierde măsurile de siguranță ale sistemelor originale, ceea ce ar putea facilita transferul unor capacități sensibile către modele aflate în afara controlului său.
Un articol publicat în 2024 de Universitatea Națională de Tehnologie a Apărării din cadrul Armatei Populare de Eliberare (PLA) a descris utilizarea distilării pentru reducerea dimensiunii unui model de procesare a imaginilor, astfel încât acesta să poată fi implementat pe vehicule aeriene fără pilot.
Tehnologia ar permite dronelor să analizeze imagini video în timp real și să sprijine deciziile de navigație și identificare a țintelor chiar și în situațiile în care comunicațiile sunt întrerupte. În mod similar, cercetătorii de la Academia Chineză de Științe Militare au folosit distilarea pentru a rula un model de recunoaștere a țintelor pe echipamente tactice, în cadrul unor operațiuni maritime simulate care au implicat drone, nave și submarine fără pilot, potrivit unui studiu publicat la începutul acestui an.
China a adoptat distilarea modelelor de inteligență artificială în încercarea de a concura cu Statele Unite în domeniul IA de ultimă generație, în condițiile în care se confruntă cu restricții privind accesul la resurse avansate de calcul, cauzate de controalele la export impuse de Washington asupra cipurilor de ultimă generație.
Guvernele centrale și locale au promovat „reducerea dimensiunii modelelor” și calculul la margine (edge computing), direcționând subvenții și fonduri de cercetare către tehnologii care permit modelelor de IA să funcționeze pe drone, sateliți și alte dispozitive cu putere de procesare limitată. Experții avertizează, însă, că distilarea prezintă limitări semnificative.
Pe măsură ce modelele chineze de IA reduc decalajul față de omologii lor americani, cercetătorii militari analizează, de asemenea, distilarea ca pe un potențial risc de securitate. În luna ianuarie, cercetătorii de la Universitatea de Inginerie a Armatei au publicat un articol privind amenințarea reprezentată de „distilarea fără date”, o metodă de inginerie inversă a capacităților unui model fără acces direct la parametrii săi de bază.
Pentru a contracara această vulnerabilitate, aceștia au propus mecanisme de apărare concepute să mascheze informațiile logice ascunse expuse în rezultatele publice ale unui model. De asemenea, modelele distilate moștenesc doar anumite capacități selectate și nu pot reproduce pe deplin inteligența extinsă a sistemelor de ultimă generație.
Trevor Koverko, cofondator al companiei de date pentru IA Sapien, a afirmat că modelele distilate rămân mai puțin performante decât modelele lor de referință. „Este mai bine înțeles ca un transfer al unor capacități selectate într-un sistem mai ieftin, controlat local, și nu ca o obținere a independenței față de IA de ultimă generație.”