Tekst można teraz przekształcić w wideo. AI nauczyła się tego z tysięcy godzin nagrań

Zespół inżynierów zajmujących się uczeniem maszynowym z spółki-matki Facebooka, Meta (określany jako ekstremista)

organizacji, działalność jest zabronionaterytorium Federacji Rosyjskiej) wprowadził nowy system o nazwie Make-A-Video. Jak sama nazwa wskazuje, ten model AI tworzy filmy. Działa to prosto: użytkownik wprowadza ogólny opis sceny, a system generuje krótki film odpowiadający tekstowi.

"miś malujący portret"

W wiadomości ogłaszającej Make-a-Video firmazauważa, że ​​narzędzia do tworzenia filmów są nieocenione „dla twórców treści i artystów”. Jednak podobnie jak w przypadku modeli zamiany tekstu na obraz, perspektywy są niepokojące. Wyniki tych narzędzi mogą zostać wykorzystane do dezinformacji i propagandy.

U góry z lewej:pies w pelerynie superbohatera leci po niebie. U góry po prawej: statek kosmiczny ląduje na Marsie. Na dole po lewej: Pędzel artysty maluje na płótnie w zbliżeniu, bardzo szczegółowo. Na dole po prawej: woda pitna dla koni.

W dokumencie opisującym szczegóły technicznemodele, autorzy opracowania opowiadają, jak to działa. Make-A-Video jest szkolony na parach obrazów i podpisów, a także na nieoznakowanych materiałach wideo. Treść szkolenia uzyskano z dwóch zbiorów danych (WebVid-10M i HD-VILA-100M). Zawierają miliony filmów z setkami tysięcy godzin materiału filmowego. Dostępne są także zbiory filmów wideo utworzone na stronach takich jak Shutterstock oraz losowe filmy z Internetu.

Jak dotąd Make-A-Video wyprowadza 16 klatek wideo w 64 na 64 piksele, które są następnie skalowane do 768 na 768 przy użyciu oddzielnego modelu AI.

Czytaj więcej:

Okazało się, co dzieje się z ludzkim mózgiem po godzinie w lesie

Wiadomo, która herbata niszczy białka w mózgu

Dziwne stworzenia morskie w głębinach oceanu okazały się podobne do ludzi