始める無料で始める

動画の音声分離

この演習では、1980年代の Bounce 柔軟剤のテレビCM動画を分割します。画像モデルと音声モデルをそれぞれ動かすために、入力として使う映像と音声を分離しておく必要があるためです。

Frames from the Bounce TV commercial

ffmpeg_extract_subclipVideoFileClip モジュールは読み込まれています。MP4 ファイルは bounce_ad.mp4 としてダウンロード済みです。

この演習はコースの一部です

Hugging Face で学ぶマルチモーダルモデル

コースを見る

演習の手順

  • bounce_ad.mp4 から、開始 0 秒・終了 5 秒のサブクリップを作成し、出力ファイル名を bounce_ad_5s.mp4 にします。
  • 新しいサブクリップを読み込みます。
  • 音声ストリームを抽出します。
  • 音声ストリームを bounce_ad_5s.mp3 というファイル名で書き出します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Create a subclip file from bounce_ad.mp4
ffmpeg_extract_subclip(____)

# Load the new subclip
video = ____

# Extract the audio stream
audio = ____

# Write the audio stream
audio.____
コードを編集して実行