Une équipe d'ingénieurs en machine learning de la société mère de Facebook Meta (identifiée comme extrémiste)
"ours en peluche peignant un portrait"
Dans un message annonçant Make-a-Video, la sociéténote que les outils de création vidéo sont inestimables « pour les créateurs de contenu et les artistes ». Mais comme pour les modèles de conversion texte-image, les perspectives sont inquiétantes. Les résultats de ces outils peuvent être utilisés à des fins de désinformation et de propagande.
En haut à gauche:un chien dans une cape de super-héros vole dans le ciel. En haut à droite : Le vaisseau spatial atterrit sur Mars. En bas à gauche : Le pinceau de l'artiste peint sur la toile en gros plan, avec beaucoup de détails. En bas à droite : l'eau potable du cheval.
Dans un document qui décrit les détails techniquesmodèles, les auteurs du développement expliquent comment cela fonctionne. Make-A-Video est formé sur les paires image-légende ainsi que sur les séquences vidéo non étiquetées. Le contenu de la formation a été obtenu à partir de deux ensembles de données (WebVid-10M et HD-VILA-100M). Ils contiennent des millions de vidéos représentant des centaines de milliers d’heures d’images. Il existe également des vidéos d'archives créées par des sites comme Shutterstock et des vidéos aléatoires provenant d'Internet.
Jusqu'à présent, Make-A-Video produit 16 images vidéo à 64 x 64 pixels, qui sont ensuite mises à l'échelle jusqu'à 768 x 768 à l'aide d'un modèle AI distinct.
Lire la suite:
Il s'est avéré ce qui arrive au cerveau humain après une heure dans la forêt
Il est devenu connu quel thé détruit les protéines dans le cerveau
D'étranges créatures marines dans les profondeurs de l'océan se sont avérées similaires aux humains