動画の音声分離
この演習では、1980年代の Bounce 柔軟剤のテレビCM動画を分割します。画像モデルと音声モデルをそれぞれ動かすために、入力として使う映像と音声を分離しておく必要があるためです。

ffmpeg_extract_subclip と VideoFileClip モジュールは読み込まれています。MP4 ファイルは bounce_ad.mp4 としてダウンロード済みです。
この演習はコースの一部です
Hugging Face で学ぶマルチモーダルモデル
演習の手順
bounce_ad.mp4から、開始 0 秒・終了 5 秒のサブクリップを作成し、出力ファイル名をbounce_ad_5s.mp4にします。- 新しいサブクリップを読み込みます。
- 音声ストリームを抽出します。
- 音声ストリームを
bounce_ad_5s.mp3というファイル名で書き出します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Create a subclip file from bounce_ad.mp4
ffmpeg_extract_subclip(____)
# Load the new subclip
video = ____
# Extract the audio stream
audio = ____
# Write the audio stream
audio.____