Stwórz wideo!
Czas, żebyś spróbował samodzielnie wygenerować wideo na podstawie promptu tekstowego! Użyj pipeline'u CogVideoXPipeline i poniższego promptu:
A robot doing the robot dance. The dance floor has colorful squares and a glitterball.
Uwaga: Wnioskowanie na modelach do generowania wideo może trwać bardzo długo, dlatego wygenerowane wideo zostało wcześniej załadowane. Wprowadzenie innych promptów nie spowoduje wygenerowania nowych filmów.
Klasa CogVideoXPipeline została już zaimportowana.
To ćwiczenie jest częścią kursu
Modele multimodalne z Hugging Face
Instrukcje do ćwiczenia
- Utwórz
CogVideoXPipelinena podstawie checkpointuTHUDM/CogVideoX-2b. - Uruchom pipeline z podanym promptem, ustawiając liczbę kroków wnioskowania na
20, liczbę generowanych klatek na20oraz skalę guidance na6.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
prompt = "A robot doing the robot dance. The dance floor has colorful squares and a glitterball."
# Create a CogVideoXPipeline
pipe = ____(
"____",
torch_dtype=torch.float16
)
# Run the pipeline with the provided prompt
video = pipe(
prompt=____,
num_inference_steps=____,
num_frames=____,
guidance_scale=____
)
video = video.frames[0]
video_path = export_to_video(video, "output.mp4", fps=8)
video = VideoFileClip(video_path)
video.write_gif("video_ex.gif")