Facebook の研究者は、これまでで最大の自動音声認識 (ASR) モデルを発表しました。彼女は学びました
材料をアップロードする前に、科学者たちは51の言語を個別のグループに分け、各言語グループの情報のセットとして1万語彙単位を選択しました。その後、いくつかの小さな言語グループを手動で結合して、残りの6つだけになるようにしたため、モデルの学習プロセスが数倍速くなりました。
「私たちが知る限り、これは最初の作品ですが、多言語システムを大規模に研究しています。多くのリソースを必要としない、51言語の音声認識の統合アーキテクチャを受け取りました。
研究者たちは、いくつかの間に実験では、モデルの最も効果的なバージョンは28.75%の効率で単語を認識しました。この指標はアナログの指標の数倍であり、トレーニングで改善されます。
記事では、科学者たちはまた、システムの第2バージョンを間もなく公開する予定であることにも言及しました。簡単になり、わずか10分で目的の結果が得られます。彼女は5万3千時間の「原材料」を訓練されました。
また読む
-マヤ文明が彼らの都市を去ったことが判明した
-科学者はヘルペスが人間に感染する計画を明らかにしました:それは賭けゲームのようなものです
-病気の3日目、COVID-19のほとんどの患者は嗅覚を失い、鼻水に苦しむことが多い