Home » Știință » Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi
Sursa foto: Shutterstock
Publicat: 28.05.2023

Meta a creat un model de limbaj bazat pe Inteligența Artificială (AI) care, în mod surprinzător, nu este o clonă ChatGPT. Proiectul Massively Multilingual Speech (MMS) al companiei poate recunoaște peste 4.000 de limbi și poate comunica în peste 1.100 de limbi. La fel ca majoritatea celorlalte proiecte de Inteligență Artificială anunțate public, Meta a creat MMS pentru a contribui la păstrarea diversității lingvistice și pentru a încuraja cercetătorii să se bazeze pe fundația sa.

„Împărtășim în mod public modelele și codul nostru, astfel încât și alte persoane din comunitatea de cercetare să poată construi pe baza muncii noastre. Prin această muncă, sperăm să aducem o mică contribuție la conservarea diversității lingvistice incredibile din lume”, a scris compania, potrivit Engadget.

Modelele de recunoaștere a vorbirii și de transformare a textului în vorbire necesită, de obicei, o pregătire pe mii de ore de înregistrări audio cu etichete de transcriere însoțitoare. Etichetele sunt esențiale pentru învățarea automată, deoarece permit algoritmilor să clasifice corect și să „înțeleagă” datele. Dar pentru limbile care nu sunt utilizate pe scară largă în țările industrializate – multe fiind în pericol de dispariție în următoarele decenii – „aceste date pur și simplu nu există”, după cum a transmis Meta.

Meta a folosit o abordare neconvențională

Meta a folosit o abordare neconvențională pentru colectarea datelor audio: a apelat la înregistrări audio ale textelor religioase traduse.

„Ne-am orientat către texte religioase, cum ar fi Biblia, care au fost traduse în multe limbi diferite și ale căror traduceri au fost studiate pe scară largă pentru cercetarea traducerilor bazate pe text. Aceste traduceri au și înregistrări audio disponibile public ale unor persoane care citesc aceste texte în diferite limbi”, a declarat compania.

Prin încorporarea înregistrărilor neetichetate ale Bibliei și ale unor texte similare, cercetătorii Meta au crescut numărul de limbi disponibile ale modelului la peste 4.000.

„Deși conținutul înregistrărilor audio este religios, analiza noastră arată că acest lucru nu influențează modelul să producă un limbaj mai religios. Credem că acest lucru se datorează faptului că folosim o abordare de clasificare temporală conectică (CTC), care este mult mai constrânsă în comparație cu modelele mari de limbaj (LLM) sau modelele secvență-la-secvență pentru recunoașterea vorbirii”, a scris Meta.

Meta a avertizat că noile sale modele nu sunt perfecte

Combinarea surselor de date neconvenționale și a unui model de vorbire autosupravegheat a condus la rezultate impresionante.

„Rezultatele noastre arată că modelele Massively Multilingual Speech au performanțe bune în comparație cu modelele existente și acoperă de zece ori mai multe limbi”, a transmis Meta.

Totuși, Meta a avertizat că noile sale modele nu sunt perfecte.

„De exemplu, există un anumit risc ca modelul speech-to-text să transcrie greșit anumite cuvinte sau fraze. În funcție de rezultat, acest lucru ar putea duce la un limbaj ofensator și/sau inexact. Continuăm să credem că o colaborare în cadrul comunității de Inteligență Artificială este esențială pentru dezvoltarea responsabilă a tehnologiilor de AI”, a scris compania.

Vă mai recomandăm și: 

Omul din spatele ChatGPT vrea să scaneze ochii tuturor oamenilor de pe Pământ

Inteligența Artificială îi va prinde pe cei care aruncă gunoiul din mașină

Ar putea Inteligența Artificială să egaleze vreodată inteligența umană?

Chatbotul Bard de la Google a vorbit într-o limbă în care nu a fost antrenat

Claudia Cociug
Claudia Cociug
Claudia Cociug, absolventă a Facultății de Litere, specializarea Jurnalism și Științe ale Comunicării din cadrul Universității „Alexandru Ioan Cuza” din Iași, a făcut parte din echipa DESCOPERĂ.ro din noiembrie 2022 și până în iunie 2023. citește mai mult
Urmărește DESCOPERĂ.ro pe
Google News și Google Showcase
Cele mai noi articole
Sateliții pot observa acum din spațiu plasticul de pe plaje
Sateliții pot observa acum din spațiu plasticul de pe plaje
Dieta keto ar putea într-o bună zi să trateze tulburările autoimune
Dieta keto ar putea într-o bună zi să trateze tulburările autoimune
Un schelet bizar din Belgia conține oase de la 5 oameni cu o vechime de 2.500 de ani
Un schelet bizar din Belgia conține oase de la 5 oameni cu o vechime de 2.500 de ani
Astronomii au găsit un tunel interstelar în „cartierul” nostru cosmic care ar duce spre cea mai apropiată stea de Soare
Astronomii au găsit un tunel interstelar în „cartierul” nostru cosmic care ar duce spre cea mai apropiată stea de Soare
Microsoft introduce funcții de Inteligență Artificială în Notepad și Paint
Microsoft introduce funcții de Inteligență Artificială în Notepad și Paint
Radiațiile de la Cernobîl nu par să mai afecteze animalele din zona de excludere
Radiațiile de la Cernobîl nu par să mai afecteze animalele din zona de excludere
Roverul Zhurong al Chinei a găsit noi dovezi pentru un ocean străvechi pe Marte
Roverul Zhurong al Chinei a găsit noi dovezi pentru un ocean străvechi pe Marte
Tanchistul-poet, copil de ţăran, care a schimbat istoria cu armele sale
Tanchistul-poet, copil de ţăran, care a schimbat istoria cu armele sale
Prințul William a povestit ce s-a întâmplat în familia regală după ce Regele Charles și Prințesa de Wales au fost diagnosticați cu cancer
Prințul William a povestit ce s-a întâmplat în familia regală după ce Regele Charles și Prințesa de Wales au fost ...
Un fost general din Guatemala ar putea primi 2.860 de ani de închisoare pentru crime împotriva umanității
Un fost general din Guatemala ar putea primi 2.860 de ani de închisoare pentru crime împotriva umanității
Meteorologii anunță vreme schimbătoare în România până la mijlocul lunii decembrie
Meteorologii anunță vreme schimbătoare în România până la mijlocul lunii decembrie
Cât trebuie să dormim ca „să îmbătrânim cu succes”
Cât trebuie să dormim ca „să îmbătrânim cu succes”
Cel mai ambițios studiu al cerului de până acum ar putea dezvălui misterele materiei și energiei întunecate
Cel mai ambițios studiu al cerului de până acum ar putea dezvălui misterele materiei și energiei întunecate
„O sclipire de cupru ne-a atras atenția”: Pumnal vechi de 4.000 de ani, descoperit într-o peșteră din Italia
„O sclipire de cupru ne-a atras atenția”: Pumnal vechi de 4.000 de ani, descoperit într-o peșteră din Italia
Planeta Venus ascunde cratere de impact nemaivăzute până acum
Planeta Venus ascunde cratere de impact nemaivăzute până acum
Iată cum dozele de aluminiu ar putea face șoselele mai sigure!
Iată cum dozele de aluminiu ar putea face șoselele mai sigure!
Pot păianjenii să doarmă?
Pot păianjenii să doarmă?
Care este cel mai vechi oraș locuit continuu din lume?
Care este cel mai vechi oraș locuit continuu din lume?