Onderzoekers van Carnegie Mellon University hebben een machine learning-model ontwikkeld dat schattingen maakt
AI weet dat het luidste en helderste geluid altijd isgericht op een bepaald onderwerp. Alle andere spraakopdrachten klinken zachter, vertraagd of gedempt. Het model begrijpt ook dat spraakfrequenties variëren afhankelijk van de richting waarin u zich bevindt. De lagere frequenties zijn meestal meer omnidirectioneel.
Deze methode vereist niet veel geheugen en het verzenden van geluidsgegevens naar de cloud, merkten de onderzoekers op.
Ze voegden dat toe om het systeem te implementerenhet zal nog een aantal jaren duren. Het team heeft de code al in het publieke domein gepubliceerd - alle onderzoekers kunnen deze gebruiken. Met dit systeem kan een slimme speaker worden gevraagd om muziek af te spelen zonder trefwoorden te gebruiken. Het apparaat kan ook reageren op opdrachten, zelfs als de gebruiker zich in een andere kamer bevindt.
Lees ook
De jaarlijkse missie in het noordpoolgebied is afgelopen en de gegevens zijn teleurstellend. Wat staat de mensheid te wachten?
Wetenschappers proberen te begrijpen hoe lang een neutron leeft. Waarom is het zo moeilijk en belangrijk?
Astronomen hebben een quasar ontdekt met de sterkste wind