Появи се AI, който ще подобри зрението на роботите без скъпи сензори

Учени от института AIRI представиха на международна научна конференция за виртуални и

добавена реалност ISMAR 2022 в Сингапур AI модели за изграждане на „дълбочинни карти“. Технологията помага за подобряване на компютърното зрение без използването на скъпи сензори.

Дълбочинният анализ е една от основните задачиприложения за компютърно зрение. За да може роботът да се ориентира в пространството и филтърът за добавена реалност да бъде насложен върху желаното изображение, системата трябва правилно да оцени разстоянията до всеки обект в кадъра.

По правило картите на дълбочината се изграждат на базата наинформация, идваща от специални сензори. Най-популярният от тях е лидарът. Това устройство насочва лъч светлина и измерва времето, необходимо на отражението да се върне. Недостатъци на тази технология: ограничен обхват и висока цена на сензорите. Като алтернатива се използват и RGB камери. Този метод се използва при разработването на различни AR приложения за смартфони.

Новата технология комбинира различни подходи къмрешение на проблема с оценката на дълбочината. Изследователите са разработили модели, които използват глобална пространствена информация, за да създадат най-точните карти. Предложеният модел съчетава предимствата на трансформаторите и конволюционните невронни мрежи. Авторите отбелязват, че моделът се самообучава и не се нуждае от данни от сензори за дълбочина.

Разработчиците съобщиха, че предложеният методпремина оценката на ефективността на независими масиви от данни и показа един от най-добрите резултати в света. Информацията за моделите и методите е обещана скоро да бъде публично достъпна.

Прочетете още:

НАСА разкри произхода на Хаумеа - най-загадъчната планета в Слънчевата система

„Тъмната материя“ на генома скри лечението на рака: какво откриха учените там

Пет милиона години смърт: защо „Великото умиране“ наистина отне толкова време