Nowy model automatycznego rozpoznawania Facebooka działa w 51 językach

Badacze Facebooka zaprezentowali największy jak dotąd model automatycznego rozpoznawania mowy (ASR). Nauczyła się

po nauczeniu rozumie 51 języków16 tysięcy godzin nagrań głosowych. W artykule opublikowanym na Arxiv.org współautorzy pracy twierdzą, że system, który zawiera około miliarda parametrów, poprawia wydajność rozpoznawania mowy aż o 28,8%.

Przed przesłaniem materiałów naukowcy udostępnili51 języków na osobne grupy, a następnie wybrano 10 tysięcy jednostek słownika jako zestaw informacji dla każdej grupy językowej. Następnie ręcznie połączyli kilka małych grup językowych, dopóki nie mieli zaledwie 6 lat. Przyspieszyło to proces uczenia się modelu kilka razy.

„O ile wiemy, jest to pierwsza praca,który bada systemy wielojęzyczne na masową skalę. Mamy zunifikowaną architekturę rozpoznawania mowy dla 51 języków, która nie wymaga dużych zasobów ”- zauważył Facebook.

Badacze informują o tym w ciągu kilkuW eksperymentach najbardziej efektywna wersja ich modelu rozpoznała słowa z wydajnością 28,75%. Wskaźnik ten jest kilkakrotnie wyższy niż analogów i poprawi się wraz z treningiem.

W artykule naukowcy zauważyli również, że wkrótce opublikują drugą wersję systemu. To stało się prostsze i osiąga pożądane wyniki w zaledwie 10 minut. Przeszkolono ją przez 53 tysiące godzin „surowych” materiałów.

Czytaj także

- Okazało się, że cywilizacja Majów opuściła swoje miasta

- Naukowcy ujawnili plan zarażenia wirusem opryszczki u ludzi: wygląda to na grę z zakładami

- W 3. dniu choroby większość pacjentów z COVID-19 traci zmysł węchu i często cierpi na katar