이제 텍스트를 비디오로 변환할 수 있습니다. AI는 수천 시간의 녹음을 통해 이것을 배웠습니다.

Facebook의 모회사인 Meta의 머신러닝 엔지니어 팀(극단주의자로 식별됨)

조직, 활동이 금지됩니다.러시아 연방 영토)에서는 Make-A-Video라는 새로운 시스템을 도입했습니다. 이름에서 알 수 있듯이 이 AI 모델은 비디오를 만듭니다. 작동 방식은 간단합니다. 사용자가 장면에 대한 대략적인 설명을 입력하면 시스템이 해당 텍스트에 해당하는 짧은 비디오를 생성합니다.

"인물을 그리는 테디베어"

Make-a-Video를 알리는 메시지에서 회사는비디오 제작 도구는 "콘텐츠 제작자와 아티스트에게" 매우 귀중한 도구입니다. 그러나 텍스트-이미지 모델과 마찬가지로 전망도 좋지 않습니다. 이러한 도구의 결과는 허위 정보 및 선전에 사용될 수 있습니다.

왼쪽 상단:슈퍼히어로 망토를 입은 개가 하늘을 날아다닌다. 오른쪽 위: 우주선이 화성에 착륙합니다. 왼쪽 아래: 화가의 붓이 캔버스에 아주 자세하게 페인팅하고 있습니다. 오른쪽 아래: 말 마시는 물.

기술적인 내용을 기술한 문서에서모델, 개발 작성자는 작동 방식을 알려줍니다. Make-A-Video는 이미지-캡션 쌍과 레이블이 지정되지 않은 비디오 장면에 대해 교육됩니다. 훈련 콘텐츠는 두 개의 데이터 세트(WebVid-10M 및 HD-VILA-100M)에서 얻었습니다. 여기에는 수십만 시간의 영상이 포함된 수백만 개의 비디오가 포함되어 있습니다. Shutterstock과 같은 사이트에서 만든 스톡 비디오와 인터넷에서 가져온 임의의 비디오도 있습니다.

지금까지 Make-A-Video는 64 x 64픽셀의 비디오 16개 프레임을 출력한 다음 별도의 AI 모델을 사용하여 최대 768 x 768로 확장됩니다.

더 읽어보기 :

숲에서 1시간 후 인간의 뇌에 무슨 일이 일어나는지 밝혀졌다

어떤 차가 뇌에서 단백질을 파괴하는지 알려졌습니다

심해에 사는 기이한 바다생물이 인간과 흡사한 것으로 밝혀졌다.