Créez une vidéo!
À vous de jouer : créez une vidéo entièrement à partir d'un invite de texte! Vous utiliserez un pipeline CogVideoXPipeline et l'invite suivante pour guider la génération :
A robot doing the robot dance. The dance floor has colorful squares and a glitterball.
Remarque : L'inférence sur les modèles de génération vidéo peut être longue; nous avons donc préchargé la vidéo générée pour vous. Exécuter d'autres invites ne générera pas de nouvelles vidéos.
La classe CogVideoXPipeline a déjà été importée pour vous.
Cette activité fait partie du cours
Modèles multimodaux avec Hugging Face
Instructions de l’exercice
- Créez un
CogVideoXPipelineà partir du point de contrôleTHUDM/CogVideoX-2b. - Exécutez le pipeline avec l'invite fournie, en définissant le nombre d'étapes d'inférence à
20, le nombre d'images à générer à20et l'échelle de guidage à6.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
prompt = "A robot doing the robot dance. The dance floor has colorful squares and a glitterball."
# Create a CogVideoXPipeline
pipe = ____(
"____",
torch_dtype=torch.float16
)
# Run the pipeline with the provided prompt
video = pipe(
prompt=____,
num_inference_steps=____,
num_frames=____,
guidance_scale=____
)
video = video.frames[0]
video_path = export_to_video(video, "output.mp4", fps=8)
video = VideoFileClip(video_path)
video.write_gif("video_ex.gif")