Výskumníci spoločnosti Facebook predstavili najväčší model automatického rozpoznávania reči (ASR) na svete.
Pred nahraním materiálov sa vedci rozdelili51 jazykov do samostatných skupín a potom ako informačná sada pre každú jazykovú skupinu vybrali 10 000 jednotiek slovnej zásoby. Potom manuálne kombinovali niekoľko malých jazykových skupín, až kým ich nezostalo iba šesť. Tým sa proces učenia modelu niekoľkonásobne zrýchlil.
„Pokiaľ vieme, je to prvé dielo,ktorý masívne študuje viacjazyčné systémy. Dostali sme jednotnú architektúru rozpoznávania reči pre 51 jazykov, čo nevyžaduje veľa zdrojov, “poznamenal na Facebooku.
Vedci to tvrdia počas niekoľkýchexperimenty, najefektívnejšia verzia ich modelu rozpoznávala slová s účinnosťou 28,75%. Tento ukazovateľ je niekoľkonásobne vyšší ako ukazovateľ analógov a bude sa zlepšovať tréningom.
Vedci v článku tiež poznamenali, že čoskoro zverejnia druhú verziu systému. Stalo sa to jednoduchšie a dosahuje požadované výsledky len za 10 minút. Bola vycvičená na 53 tisíc hodín „surovín“.
Prečítajte si tiež
- Ukázalo sa, že mayská civilizácia opustila svoje mestá
- Vedci odhalili plán infekcie herpesom u ľudí: vyzerá to ako hra so stávkami
- V deň 3 choroby väčšina pacientov s COVID-19 stratí čuch a často trpí nádchou.