Home » Știință » Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi
Sursa foto: Shutterstock
Publicat: 28.05.2023

Meta a creat un model de limbaj bazat pe Inteligența Artificială (AI) care, în mod surprinzător, nu este o clonă ChatGPT. Proiectul Massively Multilingual Speech (MMS) al companiei poate recunoaște peste 4.000 de limbi și poate comunica în peste 1.100 de limbi. La fel ca majoritatea celorlalte proiecte de Inteligență Artificială anunțate public, Meta a creat MMS pentru a contribui la păstrarea diversității lingvistice și pentru a încuraja cercetătorii să se bazeze pe fundația sa.

„Împărtășim în mod public modelele și codul nostru, astfel încât și alte persoane din comunitatea de cercetare să poată construi pe baza muncii noastre. Prin această muncă, sperăm să aducem o mică contribuție la conservarea diversității lingvistice incredibile din lume”, a scris compania, potrivit Engadget.

Modelele de recunoaștere a vorbirii și de transformare a textului în vorbire necesită, de obicei, o pregătire pe mii de ore de înregistrări audio cu etichete de transcriere însoțitoare. Etichetele sunt esențiale pentru învățarea automată, deoarece permit algoritmilor să clasifice corect și să „înțeleagă” datele. Dar pentru limbile care nu sunt utilizate pe scară largă în țările industrializate – multe fiind în pericol de dispariție în următoarele decenii – „aceste date pur și simplu nu există”, după cum a transmis Meta.

Meta a folosit o abordare neconvențională

Meta a folosit o abordare neconvențională pentru colectarea datelor audio: a apelat la înregistrări audio ale textelor religioase traduse.

„Ne-am orientat către texte religioase, cum ar fi Biblia, care au fost traduse în multe limbi diferite și ale căror traduceri au fost studiate pe scară largă pentru cercetarea traducerilor bazate pe text. Aceste traduceri au și înregistrări audio disponibile public ale unor persoane care citesc aceste texte în diferite limbi”, a declarat compania.

Prin încorporarea înregistrărilor neetichetate ale Bibliei și ale unor texte similare, cercetătorii Meta au crescut numărul de limbi disponibile ale modelului la peste 4.000.

„Deși conținutul înregistrărilor audio este religios, analiza noastră arată că acest lucru nu influențează modelul să producă un limbaj mai religios. Credem că acest lucru se datorează faptului că folosim o abordare de clasificare temporală conectică (CTC), care este mult mai constrânsă în comparație cu modelele mari de limbaj (LLM) sau modelele secvență-la-secvență pentru recunoașterea vorbirii”, a scris Meta.

Meta a avertizat că noile sale modele nu sunt perfecte

Combinarea surselor de date neconvenționale și a unui model de vorbire autosupravegheat a condus la rezultate impresionante.

„Rezultatele noastre arată că modelele Massively Multilingual Speech au performanțe bune în comparație cu modelele existente și acoperă de zece ori mai multe limbi”, a transmis Meta.

Totuși, Meta a avertizat că noile sale modele nu sunt perfecte.

„De exemplu, există un anumit risc ca modelul speech-to-text să transcrie greșit anumite cuvinte sau fraze. În funcție de rezultat, acest lucru ar putea duce la un limbaj ofensator și/sau inexact. Continuăm să credem că o colaborare în cadrul comunității de Inteligență Artificială este esențială pentru dezvoltarea responsabilă a tehnologiilor de AI”, a scris compania.

Vă mai recomandăm și: 

Omul din spatele ChatGPT vrea să scaneze ochii tuturor oamenilor de pe Pământ

Inteligența Artificială îi va prinde pe cei care aruncă gunoiul din mașină

Ar putea Inteligența Artificială să egaleze vreodată inteligența umană?

Chatbotul Bard de la Google a vorbit într-o limbă în care nu a fost antrenat

Claudia Cociug
Claudia Cociug
Claudia Cociug, absolventă a Facultății de Litere, specializarea Jurnalism și Științe ale Comunicării din cadrul Universității „Alexandru Ioan Cuza” din Iași, a făcut parte din echipa DESCOPERĂ.ro din noiembrie 2022 și până în iunie 2023. citește mai mult
Urmărește DESCOPERĂ.ro pe
Google News și Google Showcase
Cele mai noi articole
Un strămoș al vacilor cântărea doar 450 de grame
Un strămoș al vacilor cântărea doar 450 de grame
Mark Hamill, actorul care și-a câștigat un loc etern în Universul Războiului Stelelor. „Este mai mult un basm decât un adevărat science-fiction”
Mark Hamill, actorul care și-a câștigat un loc etern în Universul Războiului Stelelor. „Este mai mult un basm decât ...
Discriminarea ar putea accelera îmbătrânirea, arată un studiu
Discriminarea ar putea accelera îmbătrânirea, arată un studiu
Rămășițele unei vaste așezări agricole veche de 7.000 de ani, găsite într-un „vid enorm” din Serbia
Rămășițele unei vaste așezări agricole veche de 7.000 de ani, găsite într-un „vid enorm” din Serbia
Oamenii de știință susțin că au găsit „busola” din creierul uman
Oamenii de știință susțin că au găsit „busola” din creierul uman
Warren Buffett, al 8-lea cel mai bogat om din lume. S-a lansat în afaceri cu gumă de mestecat, reviste și Coca-Cola
Warren Buffett, al 8-lea cel mai bogat om din lume. S-a lansat în afaceri cu gumă de mestecat, reviste și Coca-Cola
Marea Britanie a ieșit din recesiune cu cea mai rapidă creștere economică din ultimii ani
Marea Britanie a ieșit din recesiune cu cea mai rapidă creștere economică din ultimii ani
O femeie a fost prinsă dormind în compartimentul de bagaje de mână dintr-un avion
O femeie a fost prinsă dormind în compartimentul de bagaje de mână dintr-un avion
În urmă cu 19 secole era inaugurată Columna lui Traian
În urmă cu 19 secole era inaugurată Columna lui Traian
Cui revin treburile casnice și îngrijirea copiilor?
Cui revin treburile casnice și îngrijirea copiilor?
Resturi dintr-un „șobolan negru și mic”, găsite în pâinea din Tokyo
Resturi dintr-un „șobolan negru și mic”, găsite în pâinea din Tokyo
Spaniolii și indigenii sud-americani vor să recupereze marfa de pe galionul San José, considerat „Sfântul Graal” al epavelor
Spaniolii și indigenii sud-americani vor să recupereze marfa de pe galionul San José, considerat „Sfântul Graal” ...
Papa Francisc a criticat armele și contraceptivele
Papa Francisc a criticat armele și contraceptivele
Femeile care vor să rămână însărcinate ar trebui să renunțe la vaping, arată un studiu
Femeile care vor să rămână însărcinate ar trebui să renunțe la vaping, arată un studiu
Păianjenii exotici, tot mai răspândiți în Europa. Specii noi identificate în Marea Britanie
Păianjenii exotici, tot mai răspândiți în Europa. Specii noi identificate în Marea Britanie
Sahara arăta cu totul altfel acum 4.000 de ani, dezvăluie arta rupestră
Sahara arăta cu totul altfel acum 4.000 de ani, dezvăluie arta rupestră
Harrison Ford, de la dulgher la star de cinema. Meseriașul de la Hollywood
Harrison Ford, de la dulgher la star de cinema. Meseriașul de la Hollywood
„Mâna lui Dumnezeu”, structura cosmică de-a dreptul spectaculoasă, însă deloc supranaturală
„Mâna lui Dumnezeu”, structura cosmică de-a dreptul spectaculoasă, însă deloc supranaturală