Cercetătorii Facebook au dezvăluit cel mai mare model de recunoaștere automată a vorbirii (ASR) de până acum. Ea a învățat
Înainte de a încărca materialele, oamenii de știință s-au împărțit51 de limbi în grupuri separate și apoi selectate 10 mii de unități de vocabular ca set de informații pentru fiecare grup de limbi. După aceea, au combinat manual câteva grupuri de limbi mici până când au mai rămas doar șase, ceea ce a făcut procesul de învățare al modelului de câteva ori mai rapid.
„Din câte știm, aceasta este prima lucrare,care studiază sistemele multilingve la scară masivă. Am primit o arhitectură unificată de recunoaștere a vorbirii pentru 51 de limbi, care nu necesită o mulțime de resurse ", - a notat pe Facebook.
Cercetătorii raportează că pe parcursul mai multorexperimente, cea mai eficientă versiune a modelului lor a recunoscut cuvintele cu o eficiență de 28,75%. Acest indicator este de câteva ori mai mare decât cel al analogilor și se va îmbunătăți odată cu antrenamentul.
În articol, oamenii de știință au menționat, de asemenea, că vor publica în curând a doua versiune a sistemului. A devenit mai ușor și obține rezultatele dorite în doar 10 minute. A fost instruită timp de 53 de mii de ore de materii „prime”.
Citește și
- S-a dovedit că i-a făcut pe civilizația maya să-și părăsească orașele
- Oamenii de știință au dezvăluit un plan de infecție cu herpes pentru oameni: pare un joc cu pariuri
- În ziua a 3-a de boală, majoritatea pacienților cu COVID-19 își pierd simțul mirosului și adesea suferă de un nas curgător