Pojawiła się sztuczna inteligencja, która poprawi wizję robotów bez drogich czujników

Naukowcy z Instytutu AIRI zaprezentowali się na międzynarodowej konferencji naukowej poświęconej wirtualnym i

rzeczywistość rozszerzona ISMAR 2022 w Singapurze Modele AI do budowy „map głębi”. Technologia ta pomaga poprawić widzenie komputera bez użycia drogich czujników.

Analiza głębokości jest jednym z głównych zadańaplikacje widzenia komputerowego. Aby robot mógł nawigować w przestrzeni, a filtr rzeczywistości rozszerzonej nałożył się na pożądany obraz, system musi poprawnie oszacować odległości do każdego obiektu w kadrze.

Z reguły mapy głębokości są budowane na podstawieinformacje pochodzące ze specjalnych czujników. Najpopularniejszym z nich jest lidar. To urządzenie kieruje wiązkę światła i mierzy czas potrzebny do powrotu odbicia. Wady tej technologii: ograniczony zasięg i wysoki koszt czujników. Kamery RGB są również używane jako alternatywa. Ta metoda jest wykorzystywana przy opracowywaniu różnych aplikacji AR na smartfony.

Nowa technologia łączy różne podejścia dorozwiązanie problemu szacowania głębokości. Naukowcy opracowali modele wykorzystujące globalne informacje przestrzenne do tworzenia najdokładniejszych map. Zaproponowany model łączy w sobie zalety transformatorów i konwolucyjnych sieci neuronowych. Autorzy zauważają, że model jest samouczący się i nie potrzebuje danych z czujników głębokości.

Twórcy poinformowali, że proponowana metodaprzeszedł ocenę wydajności na niezależnych zestawach danych i pokazał jeden z najlepszych wyników na świecie. Obiecuje się, że informacje o modelach i metodach zostaną wkrótce udostępnione publicznie.

Czytaj więcej:

NASA ujawniła pochodzenie Haumei - najbardziej tajemniczej planety w Układzie Słonecznym

„Ciemna materia” genomu skrywała leczenie raka: co odkryli tam naukowcy

Pięć milionów lat śmierci: dlaczego „Wielkie Umieranie” trwało tak długo