CommencezCommencez gratuitement

Créez une vidéo!

À vous de jouer : créez une vidéo entièrement à partir d'un invite de texte! Vous utiliserez un pipeline CogVideoXPipeline et l'invite suivante pour guider la génération :

A robot doing the robot dance. The dance floor has colorful squares and a glitterball.

Remarque : L'inférence sur les modèles de génération vidéo peut être longue; nous avons donc préchargé la vidéo générée pour vous. Exécuter d'autres invites ne générera pas de nouvelles vidéos.

La classe CogVideoXPipeline a déjà été importée pour vous.

Cette activité fait partie du cours

Modèles multimodaux avec Hugging Face

Voir le cours

Instructions de l’exercice

  • Créez un CogVideoXPipeline à partir du point de contrôle THUDM/CogVideoX-2b.
  • Exécutez le pipeline avec l'invite fournie, en définissant le nombre d'étapes d'inférence à 20, le nombre d'images à générer à 20 et l'échelle de guidage à 6.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

prompt = "A robot doing the robot dance. The dance floor has colorful squares and a glitterball."

# Create a CogVideoXPipeline
pipe = ____(
    "____",
    torch_dtype=torch.float16
)

# Run the pipeline with the provided prompt
video = pipe(
    prompt=____,
    num_inference_steps=____,
    num_frames=____,
    guidance_scale=____
)
video = video.frames[0]

video_path = export_to_video(video, "output.mp4", fps=8)
video = VideoFileClip(video_path)
video.write_gif("video_ex.gif")
Modifier et exécuter le code