Text lze nyní změnit na video. AI se to naučila z tisíců hodin nahrávání

Tým inženýrů strojového učení z mateřské společnosti Facebooku Meta (identifikován jako extremistický)

organizace, činnosti jsou zakázány proúzemí Ruské federace) zavedl nový systém nazvaný Make-A-Video. Jak název napovídá, tento model AI natáčí videa. Funguje to jednoduše: uživatel zadá hrubý popis scény a systém vygeneruje krátké video odpovídající textu.

"medvídek maluje portrét"

Ve zprávě oznamující Make-a-Video společnostpoznamenává, že nástroje pro tvorbu videí jsou neocenitelné „pro tvůrce obsahu a umělce“. Ale stejně jako u modelů pro převod textu na obrázek existují znepokojivé vyhlídky. Výsledky těchto nástrojů lze využít k dezinformacím a propagandě.

Vlevo nahoře:pes v superhrdinském plášti letí po obloze. Vpravo nahoře: Kosmická loď přistane na Marsu. Vlevo dole: Umělcův štětec maluje na plátno ve velkém detailu. Vpravo dole: kůň pitná voda.

V dokumentu, který popisuje technické detailymodely, autoři vývoje říkají, jak to funguje. Make-A-Video je trénováno na párech obrázek-titulek a také na neoznačených videozáznamech. Obsah školení byl získán ze dvou datových sad (WebVid-10M a HD-VILA-100M). Obsahují miliony videí se stovkami tisíc hodin stopáže. Existují také videa vytvořená weby jako Shutterstock a náhodná videa z internetu.

Doposud poskytuje Make-A-Video 16 snímků videa s rozlišením 64 x 64 pixelů, které jsou následně zvětšeny až na 768 x 768 pomocí samostatného modelu umělé inteligence.

Přečtěte si více:

Ukázalo se, co se stane s lidským mozkem po hodině v lese

Bylo známo, který čaj ničí bílkoviny v mozku

Podivná mořská stvoření v hlubinách oceánu se ukázala být podobná lidem