Facebookの新しい自動認識モデルは51の言語で動作します

Facebook の研究者は、これまでで最大の自動音声認識 (ASR) モデルを発表しました。彼女は学びました

で教えられた後、51の言語を理解する16,000時間の音声録音。 Arxiv.org で公開された論文の中で、この研究の共著者らは、約 10 億個のパラメータを含むこのシステムにより、音声認識パフォーマンスが最大 28.8% 向上すると主張しています。

材料をアップロードする前に、科学者たちは51の言語を個別のグループに分け、各言語グループの情報のセットとして1万語彙単位を選択しました。その後、いくつかの小さな言語グループを手動で結合して、残りの6つだけになるようにしたため、モデルの学習プロセスが数倍速くなりました。

「私たちが知る限り、これは最初の作品ですが、多言語システムを大規模に研究しています。多くのリソースを必要としない、51言語の音声認識の統合アーキテクチャを受け取りました。

研究者たちは、いくつかの間に実験では、モデルの最も効果的なバージョンは28.75%の効率で単語を認識しました。この指標はアナログの指標の数倍であり、トレーニングで改善されます。

記事では、科学者たちはまた、システムの第2バージョンを間もなく公開する予定であることにも言及しました。簡単になり、わずか10分で目的の結果が得られます。彼女は5万3千時間の「原材料」を訓練されました。

また読む

-マヤ文明が彼らの都市を去ったことが判明した

-科学者はヘルペスが人間に感染する計画を明らかにしました:それは賭けゲームのようなものです

-病気の3日目、COVID-19のほとんどの患者は嗅覚を失い、鼻水に苦しむことが多い