Home » Știință » Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi
Sursa foto: Shutterstock
Publicat: 28.05.2023

Meta a creat un model de limbaj bazat pe Inteligența Artificială (AI) care, în mod surprinzător, nu este o clonă ChatGPT. Proiectul Massively Multilingual Speech (MMS) al companiei poate recunoaște peste 4.000 de limbi și poate comunica în peste 1.100 de limbi. La fel ca majoritatea celorlalte proiecte de Inteligență Artificială anunțate public, Meta a creat MMS pentru a contribui la păstrarea diversității lingvistice și pentru a încuraja cercetătorii să se bazeze pe fundația sa.

„Împărtășim în mod public modelele și codul nostru, astfel încât și alte persoane din comunitatea de cercetare să poată construi pe baza muncii noastre. Prin această muncă, sperăm să aducem o mică contribuție la conservarea diversității lingvistice incredibile din lume”, a scris compania, potrivit Engadget.

Modelele de recunoaștere a vorbirii și de transformare a textului în vorbire necesită, de obicei, o pregătire pe mii de ore de înregistrări audio cu etichete de transcriere însoțitoare. Etichetele sunt esențiale pentru învățarea automată, deoarece permit algoritmilor să clasifice corect și să „înțeleagă” datele. Dar pentru limbile care nu sunt utilizate pe scară largă în țările industrializate – multe fiind în pericol de dispariție în următoarele decenii – „aceste date pur și simplu nu există”, după cum a transmis Meta.

Meta a folosit o abordare neconvențională

Meta a folosit o abordare neconvențională pentru colectarea datelor audio: a apelat la înregistrări audio ale textelor religioase traduse.

„Ne-am orientat către texte religioase, cum ar fi Biblia, care au fost traduse în multe limbi diferite și ale căror traduceri au fost studiate pe scară largă pentru cercetarea traducerilor bazate pe text. Aceste traduceri au și înregistrări audio disponibile public ale unor persoane care citesc aceste texte în diferite limbi”, a declarat compania.

Prin încorporarea înregistrărilor neetichetate ale Bibliei și ale unor texte similare, cercetătorii Meta au crescut numărul de limbi disponibile ale modelului la peste 4.000.

„Deși conținutul înregistrărilor audio este religios, analiza noastră arată că acest lucru nu influențează modelul să producă un limbaj mai religios. Credem că acest lucru se datorează faptului că folosim o abordare de clasificare temporală conectică (CTC), care este mult mai constrânsă în comparație cu modelele mari de limbaj (LLM) sau modelele secvență-la-secvență pentru recunoașterea vorbirii”, a scris Meta.

Meta a avertizat că noile sale modele nu sunt perfecte

Combinarea surselor de date neconvenționale și a unui model de vorbire autosupravegheat a condus la rezultate impresionante.

„Rezultatele noastre arată că modelele Massively Multilingual Speech au performanțe bune în comparație cu modelele existente și acoperă de zece ori mai multe limbi”, a transmis Meta.

Totuși, Meta a avertizat că noile sale modele nu sunt perfecte.

„De exemplu, există un anumit risc ca modelul speech-to-text să transcrie greșit anumite cuvinte sau fraze. În funcție de rezultat, acest lucru ar putea duce la un limbaj ofensator și/sau inexact. Continuăm să credem că o colaborare în cadrul comunității de Inteligență Artificială este esențială pentru dezvoltarea responsabilă a tehnologiilor de AI”, a scris compania.

Vă mai recomandăm și: 

Omul din spatele ChatGPT vrea să scaneze ochii tuturor oamenilor de pe Pământ

Inteligența Artificială îi va prinde pe cei care aruncă gunoiul din mașină

Ar putea Inteligența Artificială să egaleze vreodată inteligența umană?

Chatbotul Bard de la Google a vorbit într-o limbă în care nu a fost antrenat

Claudia Cociug
Claudia Cociug
Claudia Cociug, absolventă a Facultății de Litere, specializarea Jurnalism și Științe ale Comunicării din cadrul Universității „Alexandru Ioan Cuza” din Iași, a făcut parte din echipa DESCOPERĂ.ro din noiembrie 2022 și până în iunie 2023. citește mai mult
Urmărește DESCOPERĂ.ro pe
Google News și Google Showcase
Cele mai noi articole
Care sunt țările în care cetățenii sunt cei mai expuși la dezinformare și fake news?
Care sunt țările în care cetățenii sunt cei mai expuși la dezinformare și fake news?
Prima aselenizare din istorie. Ziua în care sovieticii i-au umilit pe americani
Prima aselenizare din istorie. Ziua în care sovieticii i-au umilit pe americani
Orașul din România în care oamenii dau două treimi din salariu pe chirie
Orașul din România în care oamenii dau două treimi din salariu pe chirie
Care sunt cele mai bune orașe europene de vizitat la pas?
Care sunt cele mai bune orașe europene de vizitat la pas?
Cum să te îmbraci în avion? Sfaturi pentru pasageri de la soția unui pilot!
Cum să te îmbraci în avion? Sfaturi pentru pasageri de la soția unui pilot!
Vremea se încălzește în toată țara! Temperaturile anunțate de ANM
Vremea se încălzește în toată țara! Temperaturile anunțate de ANM
Cum au transformat două scânduri de lemn lumea: istoria uimitoare a uneia dintre cele mai vechi practici sportive ale omenirii
Cum au transformat două scânduri de lemn lumea: istoria uimitoare a uneia dintre cele mai vechi practici sportive ale omenirii
Care este cel mai apropiat punct de stele de pe Pământ? Răspunsul s-ar putea să te surprindă!
Care este cel mai apropiat punct de stele de pe Pământ? Răspunsul s-ar putea să te surprindă!
Rechinilor albi le crește un nou tip de dinți pe măsură ce îmbătrânesc
Rechinilor albi le crește un nou tip de dinți pe măsură ce îmbătrânesc
Leif Eriksson, omul care a ajuns în America cu cinci secole înainte de Columb
Leif Eriksson, omul care a ajuns în America cu cinci secole înainte de Columb
Iată de ce cârciumile sunt mai importante pentru societate decât ați crede
Iată de ce cârciumile sunt mai importante pentru societate decât ați crede
Locul 1. Două luni consecutiv. Peste 13 milioane de cititori. ARCMEDIA continuă să stabilească standardul în presa online din România
Locul 1. Două luni consecutiv. Peste 13 milioane de cititori. ARCMEDIA continuă să stabilească standardul în presa online ...
Cât de stresantă este viața de elev? Oamenii de știință au realizat un studiu ca să afle răspunsul
Cât de stresantă este viața de elev? Oamenii de știință au realizat un studiu ca să afle răspunsul
Progres major în diagnosticul avansat al cancerului de prostată SANADOR introduce examenul PET-CT PSMA, în premieră pentru România
Progres major în diagnosticul avansat al cancerului de prostată SANADOR introduce examenul PET-CT PSMA, în premieră pentru ...
Cum ar putea fi folosit nisipul din deșert pentru construirea caselor și a drumurilor?
Cum ar putea fi folosit nisipul din deșert pentru construirea caselor și a drumurilor?
Cancerul ar putea emite semnale care protejează creierul împotriva bolii Alzheimer
Cancerul ar putea emite semnale care protejează creierul împotriva bolii Alzheimer
Test de cultură generală. Care este cea mai bună metodă de a scoate o așchie?
Test de cultură generală. Care este cea mai bună metodă de a scoate o așchie?
Prima gaură neagră fotografiată de omenire a lansat un jet cosmic lung de 3.000 de ani-lumină
Prima gaură neagră fotografiată de omenire a lansat un jet cosmic lung de 3.000 de ani-lumină