Створіть відео!
Час спробувати створити відео повністю на основі текстового підказу! Ви використаєте конвеєр CogVideoXPipeline і такий prompt для керування генерацією:
Робот виконує танець «робот». Танцювальний майданчик має кольорові квадрати та дзеркальну кулю.
Примітка. Інференс у моделях генерації відео може тривати довго, тож ми заздалегідь завантажили для вас згенероване відео. Запуск інших prompt-ів не згенерує нові відео.
Клас CogVideoXPipeline уже імпортовано для вас.
Ця вправа є частиною курсу
Багатомодальні моделі з Hugging Face
Інструкції до вправи
- Створіть
CogVideoXPipelineіз контрольної точкиTHUDM/CogVideoX-2b. - Запустіть конвеєр із наданим prompt-ом, встановивши кількість кроків інференсу
20, кількість кадрів для генерації20та значення guidance scale6.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
prompt = "A robot doing the robot dance. The dance floor has colorful squares and a glitterball."
# Create a CogVideoXPipeline
pipe = ____(
"____",
torch_dtype=torch.float16
)
# Run the pipeline with the provided prompt
video = pipe(
prompt=____,
num_inference_steps=____,
num_frames=____,
guidance_scale=____
)
video = video.frames[0]
video_path = export_to_video(video, "output.mp4", fps=8)
video = VideoFileClip(video_path)
video.write_gif("video_ex.gif")