A szöveg most videóvá alakítható. Az AI ezt több ezer órányi felvételből tanulta meg

Gépi tanulási mérnökökből álló csapat a Facebook anyavállalatától, a Meta-tól (szélsőségesként azonosították)

szervezet, tevékenység tilosaz Orosz Föderáció területén) új rendszert vezetett be Make-A-Video néven. Ahogy a neve is sugallja, ez az AI-modell videókat készít. Egyszerűen működik: a felhasználó beír egy hozzávetőleges leírást a jelenetről, a rendszer pedig a szövegnek megfelelő rövid videót generál.

"mackó portrét fest"

A Make-a-Video-t bejelentő üzenetben a cégmegjegyzi, hogy a videókészítő eszközök felbecsülhetetlen értékűek „a tartalomkészítők és a művészek számára”. De a szöveg-kép modellekhez hasonlóan itt is vannak aggasztó kilátások. Ezen eszközök eredményei felhasználhatók dezinformációra és propagandára.

Bal felső:egy kutya szuperhősköpenyben repül át az égen. Jobbra fent: Az űrszonda leszáll a Marson. Balra lent: A művész ecsetje közelről, nagy részletességgel fest a vászonra. Jobbra lent: ló ivóvíz.

A műszaki részleteket leíró dokumentumbanmodellek, a fejlesztés szerzői elmondják, hogyan működik. A Make-A-Video kép-felirat párokra, valamint címkézetlen videofelvételekre van kiképezve. A képzési tartalom két adatkészletből származott (WebVid-10M és HD-VILA-100M). Videók millióit tartalmazzák több százezer órányi felvétellel. Vannak olyan stockvideók is, amelyeket olyan webhelyek készítettek, mint a Shutterstock, és véletlenszerű videók az internetről.

Eddig a Make-A-Video 16 képkockát 64 x 64 pixeles videót bocsát ki, amelyet aztán egy külön mesterséges intelligencia modell segítségével 768 x 768 képpontra méreteznek.

Olvass tovább:

Kiderült, mi történik az emberi aggyal egy óra erdőben töltött óra után

Ismertté vált, hogy melyik tea pusztítja el a fehérjét az agyban

Az óceán mélyén élő furcsa tengeri lényekről kiderült, hogy hasonlítanak az emberekhez