A Facebook új automatikus felismerési modellje 51 nyelven működik

A Facebook kutatói bemutatták az eddigi legnagyobb automatikus beszédfelismerő (ASR) modellt. Tanult

51 nyelvet ért, miután megtanulta16 ezer óra hangfelvétel. Az Arxiv.org oldalon megjelent cikkben a munka társszerzői azt állítják, hogy a mintegy egymilliárd paramétert tartalmazó rendszer akár 28,8%-kal javítja a beszédfelismerési teljesítményt.

Az anyagok feltöltése előtt a tudósok megosztották egymással51 nyelvet külön csoportokba, majd 10 000 szótár egységet választott információs csoportként az egyes nyelvek csoportjaihoz. Ezután néhány apró nyelvi csoportot kézzel kombináltak, amíg mindössze 6 évesek lettek. Ez többször felgyorsította a modell megtanulásának folyamatát.

"Tudomásunk szerint ez az első munka,amely tömegesen tanulmányozza a többnyelvű rendszereket. Egységes beszédfelismerési architektúrát kaptunk 51 nyelvre, amely nem igényel sok erőforrást ”- mondta a Facebook.

A kutatók beszámoltak erről többenA kísérletek során a modell leghatékonyabb változata 28,75% -os hatékonysággal ismerte fel a szavakat. Ez a mutató többször magasabb, mint az analógoké, és az edzéssel javul.

A cikkben a tudósok azt is megjegyezték, hogy hamarosan közzéteszik a rendszer második verzióját. Egyszerűbbé vált, és mindössze 10 perc alatt elérhető a kívánt eredmény. 53 ezer órán át képzett "nyers" anyagokból.

Olvassa el

- Kiderült, hogy a maja civilizáció elhagyta városát

- A tudósok felfedezték az emberek herpeszfertőzési tervét: úgy néz ki, mint egy fogadással játszott játék

- A betegség 3. napján a COVID-19-ben szenvedő betegek többsége elveszíti szaglásérzetét, és gyakran orrfolyástól szenvednek