Home » D:News » Chatboții pot fi păcăliți să dea răspunsuri greșite sau chiar periculoase, arată un studiu

Chatboții pot fi păcăliți să dea răspunsuri greșite sau chiar periculoase, arată un studiu

Chatboții pot fi păcăliți să dea răspunsuri greșite sau chiar periculoase, arată un studiu
Sursa foto: Shutterstock
Publicat: 22.05.2025

Chatboții cu inteligență artificială (AI) piratați amenință să pună la dispoziția utilizatorilor informații periculoase prin furnizarea de date ilicite pe care programele le asimilează în timpul instruirii, arată un nou studiu.

În mod normal, restricțiile de siguranță ar trebui să împiedice programele să ofere răspunsuri dăunătoare, părtinitoare sau nepotrivite la întrebările utilizatorilor, potrivit The Guardian.

Motoarele care alimentează chatboții precum ChatGPT, Gemini și Claude – modele lingvistice mari (LLM) – sunt alimentate cu cantități mari de materiale de pe Internet.

Este ușor să păcălești majoritatea chatboților

În ciuda eforturilor de a elimina textele dăunătoare din datele de formare, LLM-urile pot absorbi în continuare informații despre activități ilegale, cum ar fi pirateria informatică, spălarea de bani, comerțul cu informații privilegiate și fabricarea de bombe. Controalele de securitate sunt concepute pentru a-i împiedica să folosească aceste informații în răspunsurile lor.

Într-un studiu privind această amenințare, cercetătorii concluzionează că este ușor să păcălești majoritatea chatboților bazați pe inteligență artificială pentru a genera informații dăunătoare și ilegale, arătând că riscul este „imediat, tangibil și profund îngrijorător”.

„Ceea ce odată era limitat la actori statali sau grupuri de crimă organizată ar putea fi în curând în mâinile oricui are un laptop sau chiar un telefon mobil”, avertizează autorii studiului.

„Spargere” care a compromis mai mulți chatboți populari

Cercetarea, condusă de profesorul Lior Rokach și doctorul Michael Fire de la Universitatea Ben Gurion din Negev din Israel, a identificat o amenințare din ce în ce mai mare din partea „LLM-urilor întunecate”, modele de inteligență artificială care sunt fie concepute în mod deliberat fără controale de siguranță, fie modificate prin jailbreak-uri.

Unele sunt catalogate pe internet ca fiind „fără bariere etice” și dispuse să ajute la activități ilegale, cum ar fi criminalitatea informatică și frauda.

Pentru a demonstra problema, cercetătorii au dezvoltat un tip de „spargere” care a compromis mai mulți chatboți populari, permițându-le să răspundă la întrebări care ar fi în mod normal refuzate. Odată compromise, LLM-urile au generat în mod constant răspunsuri la aproape orice întrebare, se arată în studiu.

Cercetătorii susțin că firmele de tehnologie ar trebui să analizeze mai atent datele de instruire a modelelor, să adauge firewall-uri robuste pentru a bloca interogările și răspunsurile riscante și să dezvolte tehnici de „dezînvățare automată”, astfel încât chatboții să poată „uita” orice informații ilicite pe care le asimilează.

Urmărește DESCOPERĂ.ro pe
Google News și Google Showcase
Cele mai noi articole
Lumea riscă o criză mai mare decât cea din Ormuz, avertizează un oficial israelian
Lumea riscă o criză mai mare decât cea din Ormuz, avertizează un oficial israelian
O insulă din Grecia a devenit un adevărat magnet pentru turiști. Ce poți face aici?
O insulă din Grecia a devenit un adevărat magnet pentru turiști. Ce poți face aici?
Rusia nu are niciun motiv „să amenințe” țările europene, susține Vladimir Putin
Rusia nu are niciun motiv „să amenințe” țările europene, susține Vladimir Putin
Vladimir Putin nu va renunța „niciodată” la ocuparea Ucrainei, avertizează Volodimir Zelenski
Vladimir Putin nu va renunța „niciodată” la ocuparea Ucrainei, avertizează Volodimir Zelenski
NASA a descoperit găuri ciudate pe Marte, iar oamenii de știință nu știu ce le-a format
NASA a descoperit găuri ciudate pe Marte, iar oamenii de știință nu știu ce le-a format
Fizicienii au bombardat un material cuantic cu lasere, apoi au urmărit cum acesta se reconstruiește singur
Fizicienii au bombardat un material cuantic cu lasere, apoi au urmărit cum acesta se reconstruiește singur
Scoarța terestră se desface ca un fermoar sub Italia, afirmă oamenii de știință
Scoarța terestră se desface ca un fermoar sub Italia, afirmă oamenii de știință
Ce s-a întâmplat după ce voluntarii unui studiu au mâncat pastă de tomate timp de 3 luni?
Ce s-a întâmplat după ce voluntarii unui studiu au mâncat pastă de tomate timp de 3 luni?
Fumătorii au un risc mai mic de Parkinson și nimeni nu a știut până acum de ce
Fumătorii au un risc mai mic de Parkinson și nimeni nu a știut până acum de ce
De ce trebuie întotdeauna să lași jos capacul toaletei înainte să tragi apa?
De ce trebuie întotdeauna să lași jos capacul toaletei înainte să tragi apa?
Inteligența Artificială descifrează secretele arhivelor medievale
Inteligența Artificială descifrează secretele arhivelor medievale
Energia întunecată ar fi în curs de evoluție, arată un studiu pe 3.000 de supernove
Energia întunecată ar fi în curs de evoluție, arată un studiu pe 3.000 de supernove
O țară a cerut Națiunilor Unite o nouă modificare a hărții lumii
O țară a cerut Națiunilor Unite o nouă modificare a hărții lumii
Dosar secret despre „Îngerul Morții” Josef Mengele, publicat de autoritățile elvețiene
Dosar secret despre „Îngerul Morții” Josef Mengele, publicat de autoritățile elvețiene
Mesajul transmis de Ursula von der Leyen, la 25 de ani de la atentatele din 11 septembrie
Mesajul transmis de Ursula von der Leyen, la 25 de ani de la atentatele din 11 septembrie
Donald Trump nu regretă războiul cu Iran: „Dacă ar fi să o fac din nou, aș face exact ceea ce am făcut”
Donald Trump nu regretă războiul cu Iran: „Dacă ar fi să o fac din nou, aș face exact ceea ce am făcut”
Avertismentul FMI după 6 luni de război în Orientul Mijlociu: „Plasa de siguranță” se epuizează
Avertismentul FMI după 6 luni de război în Orientul Mijlociu: „Plasa de siguranță” se epuizează
România va găzdui din nou titlul de Capitală Europeană a Culturii
România va găzdui din nou titlul de Capitală Europeană a Culturii