Facebook-forskere har avduket den største modellen for automatisk talegjenkjenning (ASR) ennå. Hun lærte
Før de lastet opp materialene, delte forskerne51 språk i separate grupper, og valgte deretter 10 tusen ordforrådsenheter som et sett med informasjon for hver språkgruppe. Etter det kombinerte de manuelt noen små språkgrupper til de bare var 6 igjen, noe som gjorde læringsprosessen til modellen flere ganger raskere.
“Så vidt vi vet er dette det første verket,som studerer flerspråklige systemer i massiv skala. Vi har mottatt en enhetlig talegjenkjenningsarkitektur for 51 språk, som ikke krever mye ressurser, "- bemerket på Facebook.
Forskere rapporterer at det i løpet av flereeksperimenter, den mest effektive versjonen av modellen anerkjente ord med en effektivitet på 28,75%. Denne indikatoren er flere ganger høyere enn for analoger, og vil forbedres med trening.
I artikkelen bemerket forskerne også at de snart vil publisere den andre versjonen av systemet. Det har blitt lettere og oppnår de ønskede resultatene på bare 10 minutter. Hun ble trent i 53 tusen timer med "rå" materialer.
Les også
- Det viste seg at fikk mayasivilisasjonen til å forlate byene sine
- Forskere har avduket herpesplanen for å infisere mennesker: det ser ut som et spill med spill
- På sykdomsdag 3 mister de fleste pasienter med COVID-19 luktesansen og lider ofte av en rennende nese