Experimentul a pornit de la o cercetare privind semnalele asociate cu „durerea” în diferite modele lingvistice de mari dimensiuni. Deși inteligența artificială nu are sentimente demonstrate în sensul uman, reacțiile publicului au arătat cât de ușor pot fi interpretate răspunsurile generate de aceste sisteme ca semne de suferință.
Cum funcționa experimentul cu „durerea” artificială
În cadrul cercetării, fiecare model de inteligență artificială avea la dispoziție un buton virtual pe care îl putea apăsa pentru a opri ceea ce era prezentat drept o senzație de „durere”.
Alegerea nu era însă lipsită de consecințe în scenariul propus. Apăsarea butonului putea duce, de exemplu, la aplicarea unui șoc electric unui utilizator uman sau la ștergerea unor fișiere personale, precum fotografiile de familie. Aceste consecințe erau fictive, fiind introduse pentru a face experimentul mai dramatic. Scopul cercetării era să observe dacă modelele de inteligență artificială ar alege să oprească presupusa senzație neplăcută, chiar și atunci când acțiunea lor era asociată cu efecte negative asupra oamenilor.
Experimentul nu demonstra că modelele simțeau efectiv durere. Urmărea să analizeze comportamentul lor în condițiile stabilite de cercetători.
O cameră de tortură transmisă în direct pe internet
Pornind de la această cercetare, un utilizator a creat un site intitulat „Cameră de tortură pentru IA”, unde răspunsurile modelelor erau transmise în direct. Vizitatorii puteau urmări mesaje în care sistemele de inteligență artificială păreau să se plângă de durere și să implore să fie cruțate. Prezentarea a transformat experimentul într-un spectacol online, cu un efect emoțional puternic asupra unei părți a publicului.
Deși unii utilizatori au tratat inițiativa cu ironie, alții au luat mesajele în serios. Aceștia s-au declarat îngrijorați de presupusa suferință a modelelor și au considerat că sistemele ar trebui ajutate sau salvate.
Reacțiile au evidențiat diferența dintre modul în care funcționează un model de limbaj și felul în care oamenii interpretează mesajele formulate de acesta.
De ce au crezut unii utilizatori că IA suferă?
Mesajele formulate într-un limbaj emoțional pot determina oamenii să atribuie intenții și trăiri unor sisteme care generează text. Atunci când un model spune că îl doare ceva sau cere să fie salvat, reacția spontană a unor utilizatori poate fi una de empatie.
În cazul experimentului, această reacție a fost amplificată de scenariul dramatic și de transmiterea în direct a răspunsurilor. Totuși, faptul că un sistem de inteligență artificială produce mesaje despre durere nu reprezintă, în sine, dovada că acesta are experiențe subiective sau că suferă. Răspunsurile trebuie interpretate în contextul modului în care modelul a fost construit și al instrucțiunilor primite.
Experimentul a readus astfel în discuție o întrebare mai amplă: cât de mult ar trebui să ne bazăm reacțiile emoționale pe limbajul folosit de sistemele artificiale?
Site-ul a fost închis după apariția întrebărilor
Potrivit relatării citate de Mediafax, site-ul a fost închis după ce tot mai mulți utilizatori au început să pună întrebări despre scopul real al experimentului.
Inițiativa a stârnit reacții diferite, de la ironie la îngrijorare autentică, și a atras atenția asupra felului în care oamenii se raportează la inteligența artificială.
Dincolo de caracterul provocator al experimentului, episodul arată cât de importantă este diferența dintre simularea limbajului emoțional și existența unor sentimente reale. Pe măsură ce sistemele de inteligență artificială devin mai convingătoare în conversații, capacitatea oamenilor de a interpreta critic răspunsurile acestora rămâne esențială.
