テキストをビデオに変換できるようになりました。 AIは何千時間もの記録からこれを学びました

Facebookの親会社であるMeta(過激派として認識されている)の機械学習エンジニアのチーム

組織、活動は禁止されていますロシア連邦領土)は、Make-A-Video と呼ばれる新しいシステムを導入しました。名前が示すように、この AI モデルは動画を作成します。仕組みは簡単です。ユーザーがシーンの大まかな説明を入力すると、システムがそのテキストに対応する短いビデオを生成します。

「肖像画を描くテディベア」

Make-a-Video を発表するメッセージの中で、同社は次のように述べています。動画作成ツールは「コンテンツクリエイターやアーティストにとって」非常に貴重であると指摘しています。しかし、テキストから画像へのモデルと同様に、憂慮すべき見通しがあります。これらのツールの結果は、偽情報やプロパガンダに使用される可能性があります。

左上:スーパーヒーローのマントを着た犬が空を飛ぶ。右上: 探査機が火星に着陸。左下: アーティストのブラシがキャンバスにクローズアップで非常に詳細に描かれています。右下:馬の飲み水。

技術的な詳細を説明する文書開発者はモデルを使用して、それがどのように機能するかを説明します。 Make-A-Video は、ラベルのないビデオ映像だけでなく、画像とキャプションのペアでもトレーニングされます。トレーニング コンテンツは 2 つのデータセット (WebVid-10M および HD-VILA-100M) から取得されました。これらには、数十万時間の映像を含む数百万のビデオが含まれています。 Shutterstock などのサイトで作成されたストック ビデオや、インターネットからのランダムなビデオもあります。

これまでのところ、Make-A-Video は 64 x 64 ピクセルで 16 フレームのビデオを出力し、別の AI モデルを使用して 768 x 768 に拡大します。

続きを読む:

森の中で1時間過ごした後、人間の脳に何が起こるかが判明

どのお茶が脳内のタンパク質を破壊するかが判明

深海に生息する奇妙な海洋生物が人間に似ていることが判明