페이스북 연구진이 사상 최대 규모의 자동 음성 인식(ASR) 모델을 공개했습니다. 그녀는 배웠다
자료를 업로드하기 전에 과학자들은51 개 언어를 별도의 그룹으로 만든 다음 각 언어 그룹에 대한 정보 집합으로 1 만 어휘 단위를 선택했습니다. 그 후 소수의 언어 그룹이 6 개만 남을 때까지 수동으로 결합하여 모델의 학습 과정을 몇 배 더 빠르게했습니다.
“우리가 아는 한 이것은 첫 번째 작업입니다.다국어 시스템을 대규모로 연구합니다. 우리는 많은 리소스를 필요로하지 않는 51 개 언어에 대한 음성 인식의 통합 아키텍처를 받았습니다.
연구원들은 여러실험에서 가장 효과적인 버전은 28.75 %의 효율성으로 단어를 인식했습니다. 이 지표는 아날로그 지표보다 몇 배 더 높으며 훈련을 통해 향상됩니다.
이 기사에서 과학자들은 곧 시스템의 두 번째 버전을 게시 할 것이라고 언급했습니다. 더 쉬워지고 단 10 분만에 원하는 결과를 얻을 수 있습니다. 그녀는 53,000 시간의 "원료"에 대한 교육을 받았습니다.
읽어보기
-마야 문명이 도시를 떠난 것으로 판명되었습니다
-과학자들은 헤르페스가 인간을 감염시킬 계획을 밝혔습니다.
-질병의 셋째 날, 대부분의 COVID-19 환자는 후각을 잃고 종종 콧물로 고통받습니다.