Новая нейронная сеть может различать отдельных людей и объекты на видео, а также ускорять или замедлять их
Hiervoor het team van Google en OxfordDe universiteit verdeelde elk videoframe in afzonderlijke lagen en leerde AI om mensen of objecten erin te identificeren. Dit neurale netwerk richt zich op dingen op elke laag, concentreert zich op hun bewegingen, en kan vervolgens elk object scheiden en hun beweging veranderen.

Ученые определили верхний лимит скорости звука
Ранее Google придумали модель, которая может считывать язык жестов во время видеозвонков. ИИ может определять «активно говорящего», но игнорирует собеседника, если он просто двигает руками или головой. Новая разработка исследователей Google способна делать это с большой эффективностью и небольшими задержками. Пока исследователи отмечают, что определение языка жестов приводят к задержке или ухудшению качества видео, однако эту проблему можно решить, а сама модель осталась легкой и надежной.
Het systeem voert de video eerst door het model ondergenaamd PoseNet, dat de positie van het lichaam en ledematen in elk frame beoordeelt. Vereenvoudigde visuele informatie wordt naar een model gestuurd dat getraind is in het positioneren van gegevens uit video's van mensen die gebarentaal gebruiken, en vergelijkt de afbeelding met hoe mensen gewoonlijk bepaalde woorden weergeven.
Lees ook
Op dag 3 van de ziekte verliezen de meeste COVID-19-patiënten hun reukvermogen en hebben ze vaak een loopneus
Bekijk de dichtstbijzijnde opnamen van het oppervlak van de zon
De Doomsday-gletsjer bleek gevaarlijker te zijn dan wetenschappers dachten. We vertellen het belangrijkste