Чудесна новина: Учените преподават техники на AI, за да избегнат преследването

Учен от Пекинския университет наскоро публикува препринт на научна статия с подробности

система, базирана на видеоигри, предназначена да обучава AI хостове да избягват преследването.

Каква е същността

Повечето изследвания в жанра“преследване-избягване” в AI и теорията на игрите се занимават с обучение на машини да изследват космоса. Тъй като повечето AI обучения включват система, която награждава машината за постигане на цел, разработчиците често използват геймификация като стимул за учене.

С други думи, не можете просто да залепите робот в стаята и да кажете „направете това“. Трябва да му поставите цели и причина да ги постигне. Ето защоизследователите разработват AI, който по своята същност се стреми да възнагради,

Традиционната среда за обучение на разузнаване е предизвикателствоAI агент има за задача да манипулира цифрови модели, за да изследва космоса, докато изпълни целите си или намери награда. Напомня на Pac Man: AI трябва да се движи из околната среда, докато не изяде всички пелети за награда.

История на въпроса

Още от системите за изкуствен интелект на DeepMindусвоил шах и давай, SCII се превърна в основната среда за обучение за състезателен AI. Това е игра, в която играчите, AI или комбинациите от играчи и AI естествено се противопоставят един на друг.

Но по -важното е DeepMind и другиизследователски организации вече са свършили усилената работа по превръщането на изходния код на играта в AI площадка с няколко мини игри, които позволяват на разработчиците да се съсредоточат върху работата си.

Изследователят Xun Huang, гореспоменатият ученот Пекинския университет, се зае да изучава “парадигмата за избягване на преследване” за обучение на AI модели. Но открих, че SCII моделът има някои ограничаващи ограничения: във вградената версия на играта “pursuit-evasion” Контролът над преследвачите може да бъде поверен само на AI.

Основната схема включва три преследваниягерой (представен от войниците от играта) и 25 героя за укриване (представен от извънземните от играта). Има и режим, който използва “мъглата на войната” за да затъмни картата, което затруднява преследвача да открие и унищожи укриващия, но според изследвания това е режим 1V1.

Смешно, но основно поведение 25Стратегията на Доджърс е да останат неподвижни, където и да се появят, и след това да атакуват преследвачите си на място. Тъй като преследвачите са много по-силни от укриващите се, това води до очакваното унищожаване на всеки укриващ се веднага след откриването му.

Перспективи

Статията на Хуанг описва подробно парадигматаAI обучение в SCII среда, което се фокусира върху обучението на AI да избягва преследвачите. В тяхната версия AI се опитва да се скрие в „мъглата на войната“, за да избегне залавянето и смъртта.

Това е едно завладяващо изследване, използващовидео игри, които могат да имат огромни последици за реалния свят. Най-напредналите военни организации в света използват видео игри, за да обучават хора. И разработчиците на AI използват тези учебни среди, за да подготвят AI мозъците за живот в истински робот.

Чисто теоретично работата на Хуанг изглеждавълнуващо. Но само си представете робот Boston Dynamics, надарен със способността не просто да тича и да скача из обекта, но целенасочено да избягва преследването от отряд специални сили.

Източник: arxiv, deepmind, thenextweb

Илюстрации: goodfon

</ P>