始める無料で始める

キーワード引数を渡す

この演習では、パイプライン内でモデル関数にキーワード引数を渡す方法を学びます。

ここでは、Meta の小型モデルである MusicGen を使います。これはテキスト説明や音声プロンプトに基づいて音楽サンプルを生成できます。

pipeline モジュールは読み込まれており、soundfile ライブラリは sf として利用できます。

この演習はコースの一部です

Hugging Face で学ぶマルチモーダルモデル

コースを見る

演習の手順

  • PyTorch フレームワークで facebook/musicgen-small モデルを使い、text-to-audio パイプラインを読み込みます。
  • 生成温度を 0.8max_new_tokens1 に設定する辞書 generate_kwargs を作成します。
  • "Classic rock riff" というプロンプトを使って音声配列を生成し、generate_kwargs 辞書で生成パラメータを調整します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")

# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}

# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])
コードを編集して実行