Текстът вече може да се превърне във видеоклип. AI научи това от хиляди часове запис

Екип от инженери по машинно обучение от компанията майка на Facebook Meta (идентифицирана като екстремистка)

организация, дейности са забранени затеритория на Руската федерация) въведе нова система, наречена Make-A-Video. Както подсказва името, този AI модел прави видеоклипове. Работи просто: потребителят въвежда грубо описание на сцената и системата генерира кратко видео, съответстващо на текста.

"плюшено мече рисува портрет"

В съобщение, обявяващо Make-a-Video, компаниятаотбелязва, че инструментите за създаване на видео са безценни „за създателите на съдържание и артистите“. Но както при моделите текст към изображение, има обезпокоителни перспективи. Резултатите от тези инструменти могат да се използват за дезинформация и пропаганда.

Горе вляво:куче в пелерина на супергерой лети през небето. Горе вдясно: Космическият кораб каца на Марс. Долу вляво: четката на художника рисува върху платното в едър план, с много детайли. Долу вдясно: кон пие вода.

В документ, който описва техническите подробностимодели, авторите на разработката разказват как работи. Make-A-Video се обучава на двойки изображение-надпис, както и на немаркирани видеозаписи. Съдържанието на обучението е получено от два набора от данни (WebVid-10M и HD-VILA-100M). Те съдържат милиони видеоклипове със стотици хиляди часове кадри. Има и стокови видеоклипове, създадени от сайтове като Shutterstock и произволни видеоклипове от Интернет.

Досега Make-A-Video извежда 16 видео кадъра с 64 на 64 пиксела, които след това се мащабират до 768 на 768 с помощта на отделен AI модел.

Прочетете още:

Оказа се какво се случва с човешкия мозък след един час в гората

Стана известно кой чай разрушава протеините в мозъка

Странни морски обитатели в дълбините на океана се оказаха подобни на хората