キーワード引数を渡す
この演習では、パイプライン内でモデル関数にキーワード引数を渡す方法を学びます。
ここでは、Meta の小型モデルである MusicGen を使います。これはテキスト説明や音声プロンプトに基づいて音楽サンプルを生成できます。
pipeline モジュールは読み込まれており、soundfile ライブラリは sf として利用できます。
この演習はコースの一部です
Hugging Face で学ぶマルチモーダルモデル
演習の手順
- PyTorch フレームワークで
facebook/musicgen-smallモデルを使い、text-to-audioパイプラインを読み込みます。 - 生成温度を
0.8、max_new_tokensを1に設定する辞書generate_kwargsを作成します。 "Classic rock riff"というプロンプトを使って音声配列を生成し、generate_kwargs辞書で生成パラメータを調整します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")
# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}
# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])