Un team di ingegneri di machine learning della società madre di Facebook, Meta (identificata come estremista)
"orsacchiotto che dipinge un ritratto"
In un messaggio che annuncia Make-a-Video, l'aziendasottolinea che gli strumenti per la creazione di video hanno un valore inestimabile “per i creatori di contenuti e gli artisti”. Ma come nel caso dei modelli text-to-image, ci sono prospettive preoccupanti. I risultati di questi strumenti possono essere utilizzati per disinformazione e propaganda.
In alto a sinistra:un cane con un mantello da supereroe vola nel cielo. In alto a destra: la navicella spaziale atterra su Marte. In basso a sinistra: il pennello dell'artista dipinge sulla tela in primo piano, in grande dettaglio. In basso a destra: acqua potabile del cavallo.
In un documento che descrive i dettagli tecnicimodelli, gli autori dello sviluppo raccontano come funziona. Make-A-Video è addestrato su coppie di immagini-didascalie e su riprese video senza etichetta. Il contenuto della formazione è stato ottenuto da due set di dati (WebVid-10M e HD-VILA-100M). Contengono milioni di video con centinaia di migliaia di ore di riprese. Ci sono anche video stock creati da siti come Shutterstock e video casuali da Internet.
Finora, Make-A-Video emette 16 fotogrammi di video a 64 x 64 pixel, che vengono poi scalati fino a 768 per 768 utilizzando un modello AI separato.
Leggi di più:
Si è scoperto cosa succede al cervello umano dopo un'ora nella foresta
Si è saputo quale tè distrugge le proteine nel cervello
Strane creature marine nelle profondità dell'oceano si sono rivelate simili agli umani