Home » Știință » Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi
Sursa foto: Shutterstock
Publicat: 28.05.2023

Meta a creat un model de limbaj bazat pe Inteligența Artificială (AI) care, în mod surprinzător, nu este o clonă ChatGPT. Proiectul Massively Multilingual Speech (MMS) al companiei poate recunoaște peste 4.000 de limbi și poate comunica în peste 1.100 de limbi. La fel ca majoritatea celorlalte proiecte de Inteligență Artificială anunțate public, Meta a creat MMS pentru a contribui la păstrarea diversității lingvistice și pentru a încuraja cercetătorii să se bazeze pe fundația sa.

„Împărtășim în mod public modelele și codul nostru, astfel încât și alte persoane din comunitatea de cercetare să poată construi pe baza muncii noastre. Prin această muncă, sperăm să aducem o mică contribuție la conservarea diversității lingvistice incredibile din lume”, a scris compania, potrivit Engadget.

Modelele de recunoaștere a vorbirii și de transformare a textului în vorbire necesită, de obicei, o pregătire pe mii de ore de înregistrări audio cu etichete de transcriere însoțitoare. Etichetele sunt esențiale pentru învățarea automată, deoarece permit algoritmilor să clasifice corect și să „înțeleagă” datele. Dar pentru limbile care nu sunt utilizate pe scară largă în țările industrializate – multe fiind în pericol de dispariție în următoarele decenii – „aceste date pur și simplu nu există”, după cum a transmis Meta.

Meta a folosit o abordare neconvențională

Meta a folosit o abordare neconvențională pentru colectarea datelor audio: a apelat la înregistrări audio ale textelor religioase traduse.

„Ne-am orientat către texte religioase, cum ar fi Biblia, care au fost traduse în multe limbi diferite și ale căror traduceri au fost studiate pe scară largă pentru cercetarea traducerilor bazate pe text. Aceste traduceri au și înregistrări audio disponibile public ale unor persoane care citesc aceste texte în diferite limbi”, a declarat compania.

Prin încorporarea înregistrărilor neetichetate ale Bibliei și ale unor texte similare, cercetătorii Meta au crescut numărul de limbi disponibile ale modelului la peste 4.000.

„Deși conținutul înregistrărilor audio este religios, analiza noastră arată că acest lucru nu influențează modelul să producă un limbaj mai religios. Credem că acest lucru se datorează faptului că folosim o abordare de clasificare temporală conectică (CTC), care este mult mai constrânsă în comparație cu modelele mari de limbaj (LLM) sau modelele secvență-la-secvență pentru recunoașterea vorbirii”, a scris Meta.

Meta a avertizat că noile sale modele nu sunt perfecte

Combinarea surselor de date neconvenționale și a unui model de vorbire autosupravegheat a condus la rezultate impresionante.

„Rezultatele noastre arată că modelele Massively Multilingual Speech au performanțe bune în comparație cu modelele existente și acoperă de zece ori mai multe limbi”, a transmis Meta.

Totuși, Meta a avertizat că noile sale modele nu sunt perfecte.

„De exemplu, există un anumit risc ca modelul speech-to-text să transcrie greșit anumite cuvinte sau fraze. În funcție de rezultat, acest lucru ar putea duce la un limbaj ofensator și/sau inexact. Continuăm să credem că o colaborare în cadrul comunității de Inteligență Artificială este esențială pentru dezvoltarea responsabilă a tehnologiilor de AI”, a scris compania.

Vă mai recomandăm și: 

Omul din spatele ChatGPT vrea să scaneze ochii tuturor oamenilor de pe Pământ

Inteligența Artificială îi va prinde pe cei care aruncă gunoiul din mașină

Ar putea Inteligența Artificială să egaleze vreodată inteligența umană?

Chatbotul Bard de la Google a vorbit într-o limbă în care nu a fost antrenat

Claudia Cociug
Claudia Cociug
Claudia Cociug, absolventă a Facultății de Litere, specializarea Jurnalism și Științe ale Comunicării din cadrul Universității „Alexandru Ioan Cuza” din Iași, a făcut parte din echipa DESCOPERĂ.ro din noiembrie 2022 și până în iunie 2023. citește mai mult
Urmărește DESCOPERĂ.ro pe
Google News și Google Showcase
Cele mai noi articole
Finlanda a ridicat interdicția privind armele nucleare pe teritoriul său
Finlanda a ridicat interdicția privind armele nucleare pe teritoriul său
Stejarul lui Robin Hood din pădurea Sherwood a murit după 1.200 de ani
Stejarul lui Robin Hood din pădurea Sherwood a murit după 1.200 de ani
Un presupus prototip pentru Stonehenge, descoperit în apropiere de celebrul monument neolitic
Un presupus prototip pentru Stonehenge, descoperit în apropiere de celebrul monument neolitic
Ce se întâmplă cu industria Germaniei? Numărul angajaților a ajuns la un minim istoric
Ce se întâmplă cu industria Germaniei? Numărul angajaților a ajuns la un minim istoric
Poporul care nu a avut niciun război timp de 1.000 de ani. Ce făceau, în schimb, acești oameni?
Poporul care nu a avut niciun război timp de 1.000 de ani. Ce făceau, în schimb, acești oameni?
De ce acasă este, uneori, cel mai rău loc
De ce acasă este, uneori, cel mai rău loc
Lipsa de somn poate afecta memoria socială. Ce au descoperit cercetătorii despre rolul cafelei
Lipsa de somn poate afecta memoria socială. Ce au descoperit cercetătorii despre rolul cafelei
Cum afectează abandonul repetat comportamentul animalelor
Cum afectează abandonul repetat comportamentul animalelor
Cea mai veche brânză descoperită vreodată a fost cândva hrană pentru viața de apoi
Cea mai veche brânză descoperită vreodată a fost cândva hrană pentru viața de apoi
Filmele care se luptă pentru titlul de cel mai mare succes al anului 2026. Cine va câștiga războiul de la box-office?
Filmele care se luptă pentru titlul de cel mai mare succes al anului 2026. Cine va câștiga războiul de la box-office?
Cum ajung oamenii să nu mai iubească pe cineva. De ce despărțirea reală începe mult mai târziu decât credem
Cum ajung oamenii să nu mai iubească pe cineva. De ce despărțirea reală începe mult mai târziu decât credem
Ce este alexitimia? O problemă cu care se confruntă milioane de oameni
Ce este alexitimia? O problemă cu care se confruntă milioane de oameni
A fost descoperit un tip de accidentare specific bicicletelor electrice, iar fenomenul este îngrijorător
A fost descoperit un tip de accidentare specific bicicletelor electrice, iar fenomenul este îngrijorător
Test de cultură generală. Care este diferența dintre chefir și ayran?
Test de cultură generală. Care este diferența dintre chefir și ayran?
3 motive pentru care extratereștrii nu ne vizitează, conform științei
3 motive pentru care extratereștrii nu ne vizitează, conform științei
Care este țara europeană considerată cea mai primitoare cu străinii?
Care este țara europeană considerată cea mai primitoare cu străinii?
Un robot polițist, concediat pentru că nu a arestat pe nimeni și nu a dat nicio amendă timp de un an
Un robot polițist, concediat pentru că nu a arestat pe nimeni și nu a dat nicio amendă timp de un an
De ce nu este bine ca părinții să-și monitorizeze copiii adulți prin telefon?
De ce nu este bine ca părinții să-și monitorizeze copiii adulți prin telefon?