Facebookの親会社であるMeta(過激派として認識されている)の機械学習エンジニアのチーム
「肖像画を描くテディベア」
Make-a-Video を発表するメッセージの中で、同社は次のように述べています。動画作成ツールは「コンテンツクリエイターやアーティストにとって」非常に貴重であると指摘しています。しかし、テキストから画像へのモデルと同様に、憂慮すべき見通しがあります。これらのツールの結果は、偽情報やプロパガンダに使用される可能性があります。
左上:スーパーヒーローのマントを着た犬が空を飛ぶ。右上: 探査機が火星に着陸。左下: アーティストのブラシがキャンバスにクローズアップで非常に詳細に描かれています。右下:馬の飲み水。
技術的な詳細を説明する文書開発者はモデルを使用して、それがどのように機能するかを説明します。 Make-A-Video は、ラベルのないビデオ映像だけでなく、画像とキャプションのペアでもトレーニングされます。トレーニング コンテンツは 2 つのデータセット (WebVid-10M および HD-VILA-100M) から取得されました。これらには、数十万時間の映像を含む数百万のビデオが含まれています。 Shutterstock などのサイトで作成されたストック ビデオや、インターネットからのランダムなビデオもあります。
これまでのところ、Make-A-Video は 64 x 64 ピクセルで 16 フレームのビデオを出力し、別の AI モデルを使用して 768 x 768 に拡大します。
続きを読む:
森の中で1時間過ごした後、人間の脳に何が起こるかが判明
どのお茶が脳内のタンパク質を破壊するかが判明
深海に生息する奇妙な海洋生物が人間に似ていることが判明