Home » D:News » Chatboții pot fi păcăliți să dea răspunsuri greșite sau chiar periculoase, arată un studiu

Chatboții pot fi păcăliți să dea răspunsuri greșite sau chiar periculoase, arată un studiu

Chatboții pot fi păcăliți să dea răspunsuri greșite sau chiar periculoase, arată un studiu
Sursa foto: Shutterstock
Publicat: 22.05.2025

Chatboții cu inteligență artificială (AI) piratați amenință să pună la dispoziția utilizatorilor informații periculoase prin furnizarea de date ilicite pe care programele le asimilează în timpul instruirii, arată un nou studiu.

În mod normal, restricțiile de siguranță ar trebui să împiedice programele să ofere răspunsuri dăunătoare, părtinitoare sau nepotrivite la întrebările utilizatorilor, potrivit The Guardian.

Motoarele care alimentează chatboții precum ChatGPT, Gemini și Claude – modele lingvistice mari (LLM) – sunt alimentate cu cantități mari de materiale de pe Internet.

Este ușor să păcălești majoritatea chatboților

În ciuda eforturilor de a elimina textele dăunătoare din datele de formare, LLM-urile pot absorbi în continuare informații despre activități ilegale, cum ar fi pirateria informatică, spălarea de bani, comerțul cu informații privilegiate și fabricarea de bombe. Controalele de securitate sunt concepute pentru a-i împiedica să folosească aceste informații în răspunsurile lor.

Într-un studiu privind această amenințare, cercetătorii concluzionează că este ușor să păcălești majoritatea chatboților bazați pe inteligență artificială pentru a genera informații dăunătoare și ilegale, arătând că riscul este „imediat, tangibil și profund îngrijorător”.

„Ceea ce odată era limitat la actori statali sau grupuri de crimă organizată ar putea fi în curând în mâinile oricui are un laptop sau chiar un telefon mobil”, avertizează autorii studiului.

„Spargere” care a compromis mai mulți chatboți populari

Cercetarea, condusă de profesorul Lior Rokach și doctorul Michael Fire de la Universitatea Ben Gurion din Negev din Israel, a identificat o amenințare din ce în ce mai mare din partea „LLM-urilor întunecate”, modele de inteligență artificială care sunt fie concepute în mod deliberat fără controale de siguranță, fie modificate prin jailbreak-uri.

Unele sunt catalogate pe internet ca fiind „fără bariere etice” și dispuse să ajute la activități ilegale, cum ar fi criminalitatea informatică și frauda.

Pentru a demonstra problema, cercetătorii au dezvoltat un tip de „spargere” care a compromis mai mulți chatboți populari, permițându-le să răspundă la întrebări care ar fi în mod normal refuzate. Odată compromise, LLM-urile au generat în mod constant răspunsuri la aproape orice întrebare, se arată în studiu.

Cercetătorii susțin că firmele de tehnologie ar trebui să analizeze mai atent datele de instruire a modelelor, să adauge firewall-uri robuste pentru a bloca interogările și răspunsurile riscante și să dezvolte tehnici de „dezînvățare automată”, astfel încât chatboții să poată „uita” orice informații ilicite pe care le asimilează.

Urmărește DESCOPERĂ.ro pe
Google News și Google Showcase
Cele mai noi articole
De la cluburile din Țara Galilor, pe locul 1 în America. Povestea extraordinară a lui Bonnie Tyler
De la cluburile din Țara Galilor, pe locul 1 în America. Povestea extraordinară a lui Bonnie Tyler
Oamenii de știință au creat siliciu ultra-curat pentru cipuri cuantice din generația următoare
Oamenii de știință au creat siliciu ultra-curat pentru cipuri cuantice din generația următoare
Un șarpe din Cretacic s-a conservat atât de bine încât cercetătorii i-au putut reconstitui creierul
Un șarpe din Cretacic s-a conservat atât de bine încât cercetătorii i-au putut reconstitui creierul
Un asteroid din apropierea Pământului, monitorizat timp de 27 de ani, este de fapt altceva
Un asteroid din apropierea Pământului, monitorizat timp de 27 de ani, este de fapt altceva
Unul dintre marile mistere ale Universului este cu un pas mai aproape de rezolvare
Unul dintre marile mistere ale Universului este cu un pas mai aproape de rezolvare
Arheologii au găsit dovezi pentru ritualuri misterioase într-o peșteră timp de 25.000 de ani
Arheologii au găsit dovezi pentru ritualuri misterioase într-o peșteră timp de 25.000 de ani
Problemele financiare pot accelera îmbătrânirea creierului, avertizează un studiu
Problemele financiare pot accelera îmbătrânirea creierului, avertizează un studiu
Ar putea matematica să influențeze chiar și iubirea? Un profesor crede că da!
Ar putea matematica să influențeze chiar și iubirea? Un profesor crede că da!
Noi observații astronomice dezvăluie cum apar „atmosferele” din roiurile de galaxii
Noi observații astronomice dezvăluie cum apar „atmosferele” din roiurile de galaxii
Toate vertebratele, inclusiv oamenii, împărtășesc un strămoș surprinzător, potrivit unui nou studiu
Toate vertebratele, inclusiv oamenii, împărtășesc un strămoș surprinzător, potrivit unui nou studiu
Test de cultură generală. Câte ore durează cel mai lung zbor din lume?
Test de cultură generală. Câte ore durează cel mai lung zbor din lume?
Pentru prima dată, cercetătorii au „filmat” cum se propagă o criză epileptică prin creier
Pentru prima dată, cercetătorii au „filmat” cum se propagă o criză epileptică prin creier
Psihologia explică de ce oamenii amabili ascund adesea o singurătate profundă
Psihologia explică de ce oamenii amabili ascund adesea o singurătate profundă
Care este orașul european cu cele mai bune baruri?
Care este orașul european cu cele mai bune baruri?
Hepatitele infecțioase pot apărea la orice vârstă. Semnele la care trebuie să fim atenți!
Hepatitele infecțioase pot apărea la orice vârstă. Semnele la care trebuie să fim atenți!
În urmă cu 143 de ani se năştea Il Duce
În urmă cu 143 de ani se năştea Il Duce
„Istoria iese la suprafață”: Dunărea a ajuns la cel mai scăzut nivel înregistrat vreodată în Croația
„Istoria iese la suprafață”: Dunărea a ajuns la cel mai scăzut nivel înregistrat vreodată în Croația
Spaniolii muncesc cu drag și spor: rata șomajului a scăzut sub 10%
Spaniolii muncesc cu drag și spor: rata șomajului a scăzut sub 10%