動画を作ろう!
テキストプロンプトだけで動画を作ってみましょう!ここでは CogVideoXPipeline パイプラインと、次のプロンプトを使って生成を行います。
A robot doing the robot dance. The dance floor has colorful squares and a glitterball.
注意: 動画生成モデルの推論には時間がかかるため、この演習では生成済みの動画をあらかじめ読み込んであります。別のプロンプトを実行しても新しい動画は生成されません。
CogVideoXPipeline クラスはすでにインポート済みです。
この演習はコースの一部です
Hugging Face で学ぶマルチモーダルモデル
演習の手順
THUDM/CogVideoX-2bチェックポイントからCogVideoXPipelineを作成します。- 提供されたプロンプトでパイプラインを実行し、推論ステップ数を
20、生成するフレーム数を20、guidance scale を6に設定します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
prompt = "A robot doing the robot dance. The dance floor has colorful squares and a glitterball."
# Create a CogVideoXPipeline
pipe = ____(
"____",
torch_dtype=torch.float16
)
# Run the pipeline with the provided prompt
video = pipe(
prompt=____,
num_inference_steps=____,
num_frames=____,
guidance_scale=____
)
video = video.frames[0]
video_path = export_to_video(video, "output.mp4", fps=8)
video = VideoFileClip(video_path)
video.write_gif("video_ex.gif")