Compania americană Anthropic, creatoarea modelului de inteligență artificială Claude, a publicat recent un raport amplu despre abuzurile identificate în ultimele 8 luni. Documentul arată că patru conturi au fost folosite ca un adevărat „desk de producţie editorială” pentru instituții media rusești.
Ştiri românești, transformate şi publicate în Rusia
Materiale preluate din presa din România și Republica Moldova erau procesate cu ajutorul Al. Apoi apăreau, sub altă formă, în publicații precum Sputnik, RIA Novosti sau RT.
„Un fost redactor-șef al Sputnik Moldova a folosit Claude pentru a transforma ştiri din România și Moldova, date de sondaje şi postări ale opoziției de pe rețelele sociale, în articole în limba rusă, care au fost în cele din urmă publicate pe canalul de Telegram al Sputnik Moldova și pe RIA Novosti, și răspândite printr-o rețea de publicații rusești și moldovenești pentru a crea bucle false de verificare. Aceeaşi relatare a fost preluată de diferite publicații, astfel încât să pară că a fost confirmată independent”, se arată în raportul Anthropic.
Conţinutul ajungea la public prin 4 canale diferite
Compania precizează că actorii implicați şi-au ascuns identitatea, dar materialele au fost transmise mai departe către media de stat rusă.
„Evaluăm cu mare încredere că aceștia au împărtășit în cele din urmă materialele cu media de stat și finanțate de stat din Rusia și că conținutul generat de Claude a fost în final publicat şi difuzat prin intermediul unor media aliniate statului rus, inclusiv Sputnik Moldova şi RIA Novosti pentru publicul din Moldova, Sputnik en Español pentru publicul din America Latină, Sputnik Africa pentru publicul african și redacția în limba engleză a RT pentru difuzarea globală a RT”, a precizat Anthropic.
Şapte zone de risc, analizate de companie
Raportul acoperă acțiunile contracarate de Anthropic într-un an întreg, grupate pe 7 categorii: operațiuni cibernetice, operațiuni de influențare a opiniei publice, supraveghere, înşelătorii şi fraude, cercetări legate de arme biologice, dezvoltare de arme și „distilare de modele Al” — practica prin care un model transferă capacităţile sale către altul, prin generarea de date de antrenare.
Ce modele Claude au fost folosite abuziv
Compania a precizat exact ce versiuni de Claude au fost implicate.
„Au fost folosite modelele Claude Haiku, Sonnet și Opus. Niciunul dintre cazurile de utilizare necorespunzătoare nu a implicat folosirea modelelor Claude Fable sau Mythos, cu excepția unui caz de distilare ilegală”, se arată în document.
De la aplicaţii false de întâlniri, la supraveghere politică
Lista actorilor rău-intenționați e variată: „grupuri suspectate a fi sponsorizate de stat, infractori motivați financiar, furnizori de spyware comercial, instituții de propagandă de stat și persoane motivate politic”.
Printre cazurile documentate se numără o rețea de aplicații false de întâlniri creată în China şi sisteme de supraveghere folosite în Iran şi China pentru monitorizarea disidenților.
Alerta Anthropic: pragul de intrare pentru atacuri scade rapid
Compania avertizează că nivelul de „sofisticare” cerut până acum pentru operațiuni statale de acest tip scade odată cu evoluţia modelelor Al.
„Actori rău-intenționați sofisticați și persistenți testează continuu măsurile noastre de protecție și încearcă să ocolească măsurile tehnice pe care le folosim pentru a detecta și preveni abuzul. Vom continua să ne îmbunătățim măsurile de protecție și să colaborăm cu partenerii noştri pentru a ne îmbunătăți capacitatea de a detecta, perturba și preveni folosirea neadecvată a modelelor Al”, se arată în documentul Anthropic.
