Zacznij terazZacznij za darmo

Stwórz wideo!

Czas, żebyś spróbował samodzielnie wygenerować wideo na podstawie promptu tekstowego! Użyj pipeline'u CogVideoXPipeline i poniższego promptu:

A robot doing the robot dance. The dance floor has colorful squares and a glitterball.

Uwaga: Wnioskowanie na modelach do generowania wideo może trwać bardzo długo, dlatego wygenerowane wideo zostało wcześniej załadowane. Wprowadzenie innych promptów nie spowoduje wygenerowania nowych filmów.

Klasa CogVideoXPipeline została już zaimportowana.

To ćwiczenie jest częścią kursu

Modele multimodalne z Hugging Face

Zobacz kurs

Instrukcje do ćwiczenia

  • Utwórz CogVideoXPipeline na podstawie checkpointu THUDM/CogVideoX-2b.
  • Uruchom pipeline z podanym promptem, ustawiając liczbę kroków wnioskowania na 20, liczbę generowanych klatek na 20 oraz skalę guidance na 6.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

prompt = "A robot doing the robot dance. The dance floor has colorful squares and a glitterball."

# Create a CogVideoXPipeline
pipe = ____(
    "____",
    torch_dtype=torch.float16
)

# Run the pipeline with the provided prompt
video = pipe(
    prompt=____,
    num_inference_steps=____,
    num_frames=____,
    guidance_scale=____
)
video = video.frames[0]

video_path = export_to_video(video, "output.mp4", fps=8)
video = VideoFileClip(video_path)
video.write_gif("video_ex.gif")
Edytuj i uruchom kod