Home » Știință » Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi

Inteligența Artificială de la Meta, fostul Facebook, poate recunoaște peste 4.000 de limbi
Sursa foto: Shutterstock
Publicat: 28.05.2023

Meta a creat un model de limbaj bazat pe Inteligența Artificială (AI) care, în mod surprinzător, nu este o clonă ChatGPT. Proiectul Massively Multilingual Speech (MMS) al companiei poate recunoaște peste 4.000 de limbi și poate comunica în peste 1.100 de limbi. La fel ca majoritatea celorlalte proiecte de Inteligență Artificială anunțate public, Meta a creat MMS pentru a contribui la păstrarea diversității lingvistice și pentru a încuraja cercetătorii să se bazeze pe fundația sa.

„Împărtășim în mod public modelele și codul nostru, astfel încât și alte persoane din comunitatea de cercetare să poată construi pe baza muncii noastre. Prin această muncă, sperăm să aducem o mică contribuție la conservarea diversității lingvistice incredibile din lume”, a scris compania, potrivit Engadget.

Modelele de recunoaștere a vorbirii și de transformare a textului în vorbire necesită, de obicei, o pregătire pe mii de ore de înregistrări audio cu etichete de transcriere însoțitoare. Etichetele sunt esențiale pentru învățarea automată, deoarece permit algoritmilor să clasifice corect și să „înțeleagă” datele. Dar pentru limbile care nu sunt utilizate pe scară largă în țările industrializate – multe fiind în pericol de dispariție în următoarele decenii – „aceste date pur și simplu nu există”, după cum a transmis Meta.

Meta a folosit o abordare neconvențională

Meta a folosit o abordare neconvențională pentru colectarea datelor audio: a apelat la înregistrări audio ale textelor religioase traduse.

„Ne-am orientat către texte religioase, cum ar fi Biblia, care au fost traduse în multe limbi diferite și ale căror traduceri au fost studiate pe scară largă pentru cercetarea traducerilor bazate pe text. Aceste traduceri au și înregistrări audio disponibile public ale unor persoane care citesc aceste texte în diferite limbi”, a declarat compania.

Prin încorporarea înregistrărilor neetichetate ale Bibliei și ale unor texte similare, cercetătorii Meta au crescut numărul de limbi disponibile ale modelului la peste 4.000.

„Deși conținutul înregistrărilor audio este religios, analiza noastră arată că acest lucru nu influențează modelul să producă un limbaj mai religios. Credem că acest lucru se datorează faptului că folosim o abordare de clasificare temporală conectică (CTC), care este mult mai constrânsă în comparație cu modelele mari de limbaj (LLM) sau modelele secvență-la-secvență pentru recunoașterea vorbirii”, a scris Meta.

Meta a avertizat că noile sale modele nu sunt perfecte

Combinarea surselor de date neconvenționale și a unui model de vorbire autosupravegheat a condus la rezultate impresionante.

„Rezultatele noastre arată că modelele Massively Multilingual Speech au performanțe bune în comparație cu modelele existente și acoperă de zece ori mai multe limbi”, a transmis Meta.

Totuși, Meta a avertizat că noile sale modele nu sunt perfecte.

„De exemplu, există un anumit risc ca modelul speech-to-text să transcrie greșit anumite cuvinte sau fraze. În funcție de rezultat, acest lucru ar putea duce la un limbaj ofensator și/sau inexact. Continuăm să credem că o colaborare în cadrul comunității de Inteligență Artificială este esențială pentru dezvoltarea responsabilă a tehnologiilor de AI”, a scris compania.

Vă mai recomandăm și: 

Omul din spatele ChatGPT vrea să scaneze ochii tuturor oamenilor de pe Pământ

Inteligența Artificială îi va prinde pe cei care aruncă gunoiul din mașină

Ar putea Inteligența Artificială să egaleze vreodată inteligența umană?

Chatbotul Bard de la Google a vorbit într-o limbă în care nu a fost antrenat

Claudia Cociug
Claudia Cociug
Claudia Cociug, absolventă a Facultății de Litere, specializarea Jurnalism și Științe ale Comunicării din cadrul Universității „Alexandru Ioan Cuza” din Iași, a făcut parte din echipa DESCOPERĂ.ro din noiembrie 2022 și până în iunie 2023. citește mai mult
Urmărește DESCOPERĂ.ro pe
Google News și Google Showcase
Cele mai noi articole
Churchill, Rommel și bătălia pentru Tobruk
Churchill, Rommel și bătălia pentru Tobruk
Instrument care prezice momentul în care utilizatorii vor respinge o nouă tehnologie
Instrument care prezice momentul în care utilizatorii vor respinge o nouă tehnologie
Solstițiul de vară este „calendar natural” pentru copaci. Cum îi ajută cea mai lungă zi din an?
Solstițiul de vară este „calendar natural” pentru copaci. Cum îi ajută cea mai lungă zi din an?
Dramă la examenul de bacalaureat din 1888. „A vrut să se ucidă”
Dramă la examenul de bacalaureat din 1888. „A vrut să se ucidă”
A fost Manhattan vândut olandezilor pentru doar 24 de dolari?
A fost Manhattan vândut olandezilor pentru doar 24 de dolari?
Gertrude Elion a dezvoltat medicamente revoluționare în tratarea leucemiei. Laureată Nobel pentru Fiziologie sau Medicină
Gertrude Elion a dezvoltat medicamente revoluționare în tratarea leucemiei. Laureată Nobel pentru Fiziologie sau Medicină
Ceara din urechi, indicator timpuriu al bolii Parkinson
Ceara din urechi, indicator timpuriu al bolii Parkinson
Strategia de slăbit de 5 ori mai eficientă decât Ozempic
Strategia de slăbit de 5 ori mai eficientă decât Ozempic
Care este cel mai lung pește din ocean?
Care este cel mai lung pește din ocean?
Astronomii au găsit materia „lipsă” din Univers în cele mai mari structuri cosmice
Astronomii au găsit materia „lipsă” din Univers în cele mai mari structuri cosmice
Exporturile de „somon turcesc”, crescut în „cuști” subacvatice în Marea Neagră, au explodat
Exporturile de „somon turcesc”, crescut în „cuști” subacvatice în Marea Neagră, au explodat
Unul dintre cele mai grave atacuri cibernetice din istorie. 16 miliarde de conturi, sparte de hackeri
Unul dintre cele mai grave atacuri cibernetice din istorie. 16 miliarde de conturi, sparte de hackeri
Noul Partid Popular din Rusia cere azil politic pentru miliardarul Elon Musk
Noul Partid Popular din Rusia cere azil politic pentru miliardarul Elon Musk
Prestigiul său a fost nemaiîntâlnit în perioada Renascentistă. El a scris primul tratat modern de politică
Prestigiul său a fost nemaiîntâlnit în perioada Renascentistă. El a scris primul tratat modern de politică
Asasinarea liderului suprem al Iranului ar deschide „cutia Pandorei”, avertizează Rusia
Asasinarea liderului suprem al Iranului ar deschide „cutia Pandorei”, avertizează Rusia
Solstițiul de vară 2025. Cea mai lungă zi din an și începutul verii astronomice
Solstițiul de vară 2025. Cea mai lungă zi din an și începutul verii astronomice
Pavel Durov, fondatorul Telegram, susține că ar avea peste 100 de copii în 12 țări
Pavel Durov, fondatorul Telegram, susține că ar avea peste 100 de copii în 12 țări
Un miliardar a decedat într-un mod pe care nimeni nu și l-ar fi imaginat
Un miliardar a decedat într-un mod pe care nimeni nu și l-ar fi imaginat