Il nuovo modello di riconoscimento automatico di Facebook funziona con 51 lingue

I ricercatori di Facebook hanno svelato il più grande modello di riconoscimento vocale automatico (ASR) mai realizzato. Lei ha imparato

capire 51 lingue dopo aver imparato16mila ore di registrazioni vocali. In un articolo pubblicato su Arxiv.org, i coautori del lavoro affermano che il sistema, che contiene circa un miliardo di parametri, migliora le prestazioni di riconoscimento vocale fino al 28,8%.

Prima di caricare materiali, gli scienziati hanno condiviso51 lingue in gruppi separati, quindi selezionate 10 mila unità del dizionario come un insieme di informazioni per ciascun gruppo linguistico. Successivamente, hanno combinato manualmente alcuni piccoli gruppi linguistici fino a quando non ne avevano solo 6. Ciò ha accelerato il processo di apprendimento del modello più volte.

"Per quanto ne sappiamo, questa è la prima opera,che studia sistemi multilingue su vasta scala. Abbiamo ottenuto un'architettura di riconoscimento vocale unificato per 51 lingue, che non richiede molte risorse ", ha osservato Facebook.

I ricercatori riferiscono che nel corso di diversiNegli esperimenti, la versione più efficace del loro modello ha riconosciuto le parole con un'efficienza del 28,75%. Questo indicatore è più volte superiore a quello dei coetanei e migliorerà con l'allenamento.

Nell'articolo, gli scienziati hanno anche notato che presto pubblicheranno la seconda versione del sistema. È diventato più semplice e raggiunge i risultati desiderati in soli 10 minuti. È stata addestrata per 53 mila ore di materiali "grezzi".

Leggi anche

- Si è scoperto che ha costretto la civiltà Maya a lasciare le loro città

- Gli scienziati hanno rivelato un piano di infezione da herpes per l'uomo: sembra un gioco con scommesse

- Al terzo giorno di malattia, la maggior parte dei pazienti con COVID-19 perde l'olfatto e spesso soffre di naso che cola