Текст тепер можна перетворити на відео. ІІ навчився цьому, використовуючи тисячі годин записів

Команда інженерів з машинного навчання з материнської компанії Facebook Meta (визнана екстремістською)

організацією, діяльність заборонена натериторії РФ) представила нову систему під назвою Make-A-Video. Як випливає з назви, ця модель ІІ робить відео. Все працює просто: користувач вводить приблизний опис сцени і систем генерує коротке відео, що відповідає тексту.

«плюшевий ведмедик, що малює портрет»

У повідомленні, що анонсує Make-a-Video, компаніявідзначає, що інструменти для створення відео безцінні «для творців контенту та художників». Але, як і у випадку з моделями перетворення тексту на зображення, є тривожні перспективи. Результати цих інструментів можуть бути використані для дезінформації та пропаганди.

Вгорі зліва:собака в супергероя плащ летить по небу. Вгорі праворуч: космічний корабель приземляється на Марсі. Внизу зліва: пензель художника малює на полотні крупним планом, дуже детально. Внизу праворуч: кінь, що п'є воду.

У документі, який описує технічні деталімоделі, автори розробки розповідають, як вона працює. Make-A-Video навчається на парах зображень та підписів, а також на немаркованих відеоматеріалах. Навчальний контент отримали з двох наборів даних (WebVid-10M і HD-VILA-100M). Вони — мільйони відеороликів на сотнях тисяч годин відзнятого матеріалу. Там є й стокові відеоматеріали, створені такими сайтами, як Shutterstock та рандомні відео з інтернету.

Поки що Make-A-Video виводить 16 кадрів відео з роздільною здатністю 64 на 64 пікселі, які потім збільшуються у розмірі за допомогою окремої моделі AI до 768 на 768.

Читати далі:

З'ясувалося, що відбувається з мозком людини після однієї години у лісі

Стало відомо, який чай руйнує білок у мозку

Дивні морські істоти на глибині океану виявилися схожими на людину