Zespół inżynierów zajmujących się uczeniem maszynowym z spółki-matki Facebooka, Meta (określany jako ekstremista)
"miś malujący portret"
W wiadomości ogłaszającej Make-a-Video firmazauważa, że narzędzia do tworzenia filmów są nieocenione „dla twórców treści i artystów”. Jednak podobnie jak w przypadku modeli zamiany tekstu na obraz, perspektywy są niepokojące. Wyniki tych narzędzi mogą zostać wykorzystane do dezinformacji i propagandy.
U góry z lewej:pies w pelerynie superbohatera leci po niebie. U góry po prawej: statek kosmiczny ląduje na Marsie. Na dole po lewej: Pędzel artysty maluje na płótnie w zbliżeniu, bardzo szczegółowo. Na dole po prawej: woda pitna dla koni.
W dokumencie opisującym szczegóły technicznemodele, autorzy opracowania opowiadają, jak to działa. Make-A-Video jest szkolony na parach obrazów i podpisów, a także na nieoznakowanych materiałach wideo. Treść szkolenia uzyskano z dwóch zbiorów danych (WebVid-10M i HD-VILA-100M). Zawierają miliony filmów z setkami tysięcy godzin materiału filmowego. Dostępne są także zbiory filmów wideo utworzone na stronach takich jak Shutterstock oraz losowe filmy z Internetu.
Jak dotąd Make-A-Video wyprowadza 16 klatek wideo w 64 na 64 piksele, które są następnie skalowane do 768 na 768 przy użyciu oddzielnego modelu AI.
Czytaj więcej:
Okazało się, co dzieje się z ludzkim mózgiem po godzinie w lesie
Wiadomo, która herbata niszczy białka w mózgu
Dziwne stworzenia morskie w głębinach oceanu okazały się podobne do ludzi