ПочатиПочніть безкоштовно

Створіть відео!

Час спробувати створити відео повністю на основі текстового підказу! Ви використаєте конвеєр CogVideoXPipeline і такий prompt для керування генерацією:

Робот виконує танець «робот». Танцювальний майданчик має кольорові квадрати та дзеркальну кулю.

Примітка. Інференс у моделях генерації відео може тривати довго, тож ми заздалегідь завантажили для вас згенероване відео. Запуск інших prompt-ів не згенерує нові відео.

Клас CogVideoXPipeline уже імпортовано для вас.

Ця вправа є частиною курсу

Багатомодальні моделі з Hugging Face

Переглянути курс

Інструкції до вправи

  • Створіть CogVideoXPipeline із контрольної точки THUDM/CogVideoX-2b.
  • Запустіть конвеєр із наданим prompt-ом, встановивши кількість кроків інференсу 20, кількість кадрів для генерації 20 та значення guidance scale 6.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

prompt = "A robot doing the robot dance. The dance floor has colorful squares and a glitterball."

# Create a CogVideoXPipeline
pipe = ____(
    "____",
    torch_dtype=torch.float16
)

# Run the pipeline with the provided prompt
video = pipe(
    prompt=____,
    num_inference_steps=____,
    num_frames=____,
    guidance_scale=____
)
video = video.frames[0]

video_path = export_to_video(video, "output.mp4", fps=8)
video = VideoFileClip(video_path)
video.write_gif("video_ex.gif")
Редагувати та запускати код