Новият модел за автоматично разпознаване на Facebook работи с 51 езика

Изследователите на Facebook разкриха най-големия модел за автоматично разпознаване на реч (ASR) досега. Тя научи

разбират 51 езика, след като са били преподавани на16 хиляди часа гласови записи. В статия, публикувана на Arxiv.org, съавторите на работата твърдят, че системата, която съдържа около един милиард параметъра, подобрява производителността на разпознаване на реч с до 28,8%.

Преди да качат материалите, учените се разделиха51 езика в отделни групи и след това избрани 10 000 единици речник като набор от информация за всяка езикова група. След това ръчно комбинираха няколко малки езикови групи, докато не останаха само шест от тях. Това направи процеса на обучение на модела няколко пъти по-бърз.

„Доколкото знаем, това е първото произведение,която изучава многоезичните системи в масови мащаби. Получихме единна архитектура на разпознаването на речта за 51 езика, което не изисква много ресурси ", - отбелязват във Facebook.

Изследователите съобщават, че по време на няколкоексперименти, най-ефективната версия на техния модел разпознава думи с ефективност от 28,75%. Този показател е няколко пъти по-висок от този на аналозите и ще се подобри с тренировката.

В статията учените отбелязват също, че скоро ще публикуват втората версия на системата. Стана по-лесно и постига желаните резултати само за 10 минути. Обучена е за 53 хиляди часа „сурови“ материали.

Прочетете също

- Оказа се, че накара цивилизацията на маите да напусне градовете си

- Учените разкриха план за херпес, който да заразява хората: това е като игра за залагане

- На 3-ти ден от заболяването повечето пациенти със COVID-19 губят обонянието си и често страдат от хрема