Tekst kan nå gjøres om til en video. AI lærte dette fra tusenvis av timer med opptak

Et team av maskinlæringsingeniører fra Facebooks morselskap Meta (identifisert som ekstremist)

organisasjon, aktiviteter er forbudt forterritoriet til den russiske føderasjonen) introduserte et nytt system kalt Make-A-Video. Som navnet antyder, lager denne AI-modellen videoer. Det fungerer enkelt: brukeren legger inn en grov beskrivelse av scenen, og systemet genererer en kort video som tilsvarer teksten.

"bamse maler et portrett"

I en melding som kunngjør Make-a-Video, selskapetbemerker at videoskapingsverktøy er uvurderlige «for innholdsskapere og artister». Men som med tekst-til-bilde-modeller, er det urovekkende utsikter. Resultatene av disse verktøyene kan brukes til desinformasjon og propaganda.

Øverst til venstre:en hund i en superheltkappe flyr gjennom himmelen. Øverst til høyre: Romfartøyet lander på Mars. Nederst til venstre: Kunstnerpenselen maler på lerretet i nærbilde, i stor detalj. Nederst til høyre: hestens drikkevann.

I et dokument som beskriver de tekniske detaljenemodeller, forteller forfatterne av utviklingen hvordan den fungerer. Make-A-Video er trent på bildetekstpar samt umerket videoopptak. Treningsinnholdet ble hentet fra to datasett (WebVid-10M og HD-VILA-100M). De inneholder millioner av videoer med hundretusenvis av timer med opptak. Det er også lagervideoer laget av nettsteder som Shutterstock og tilfeldige videoer fra Internett.

Så langt sender Make-A-Video ut 16 bilder med video med 64 x 64 piksler, som deretter skaleres opp til 768 x 768 ved hjelp av en separat AI-modell.

Les mer:

Det viste seg hva som skjer med menneskehjernen etter en time i skogen

Det ble kjent hvilken te som ødelegger protein i hjernen

Rare sjødyr i dypet av havet viste seg å ligne på mennesker