Tekst kan nu omdannes til en video. AI lærte dette fra tusindvis af timers optagelse

Et team af maskinlæringsingeniører fra Facebooks moderselskab Meta (anerkendt som ekstremistisk

organisation, aktiviteter er forbudt forterritorium i Den Russiske Føderation) introducerede et nyt system kaldet Make-A-Video. Som navnet antyder, laver denne AI-model videoer. Det fungerer enkelt: Brugeren indtaster en grov beskrivelse af scenen, og systemet genererer en kort video svarende til teksten.

"bamse maler et portræt"

I en meddelelse, der annoncerer Make-a-Video, skriver virksomhedenbemærker, at værktøjer til oprettelse af video er uvurderlige "for indholdsskabere og kunstnere." Men som med tekst-til-billede-modeller er der bekymrende udsigter. Resultaterne af disse værktøjer kan bruges til desinformation og propaganda.

Øverst til venstre:en hund i en superheltekappe flyver gennem himlen. Øverst til højre: Rumfartøjet lander på Mars. Nederst til venstre: Kunstnerpenslen maler på lærredet i nærbillede, meget detaljeret. Nederst til højre: hestens drikkevand.

I et dokument, der beskriver de tekniske detaljermodeller, fortæller forfatterne af udviklingen, hvordan den fungerer. Make-A-Video trænes i billedtekstpar samt umærkede videooptagelser. Træningsindholdet blev hentet fra to datasæt (WebVid-10M og HD-VILA-100M). De indeholder millioner af videoer med hundredtusindvis af timers optagelser. Der er også lagervideoer lavet af websteder som Shutterstock og tilfældige videoer fra internettet.

Indtil videre udsender Make-A-Video 16 frames video ved 64 gange 64 pixels, som derefter skaleres op til 768 gange 768 ved hjælp af en separat AI-model.

Læs mere:

Det viste sig, hvad der sker med den menneskelige hjerne efter en time i skoven

Det blev kendt, hvilken te der ødelægger protein i hjernen

Mærkelige havdyr i havets dybder viste sig at ligne mennesker