A Facebook kutatói bemutatták az eddigi legnagyobb automatikus beszédfelismerő (ASR) modellt. Tanult
Az anyagok feltöltése előtt a tudósok megosztották egymással51 nyelvet külön csoportokba, majd 10 000 szótár egységet választott információs csoportként az egyes nyelvek csoportjaihoz. Ezután néhány apró nyelvi csoportot kézzel kombináltak, amíg mindössze 6 évesek lettek. Ez többször felgyorsította a modell megtanulásának folyamatát.
"Tudomásunk szerint ez az első munka,amely tömegesen tanulmányozza a többnyelvű rendszereket. Egységes beszédfelismerési architektúrát kaptunk 51 nyelvre, amely nem igényel sok erőforrást ”- mondta a Facebook.
A kutatók beszámoltak erről többenA kísérletek során a modell leghatékonyabb változata 28,75% -os hatékonysággal ismerte fel a szavakat. Ez a mutató többször magasabb, mint az analógoké, és az edzéssel javul.
A cikkben a tudósok azt is megjegyezték, hogy hamarosan közzéteszik a rendszer második verzióját. Egyszerűbbé vált, és mindössze 10 perc alatt elérhető a kívánt eredmény. 53 ezer órán át képzett "nyers" anyagokból.
Olvassa el
- Kiderült, hogy a maja civilizáció elhagyta városát
- A tudósok felfedezték az emberek herpeszfertőzési tervét: úgy néz ki, mint egy fogadással játszott játék
- A betegség 3. napján a COVID-19-ben szenvedő betegek többsége elveszíti szaglásérzetét, és gyakran orrfolyástól szenvednek