Anahtar sözcük argümanlarını iletme
Bu egzersizde, bir pipeline içinde kullanırken model fonksiyonlarına anahtar sözcük argümanlarını nasıl ileteceğini öğreneceksin.
Bunun için, Meta'nın metin açıklamaları veya ses istemlerine göre müzik örnekleri üretebilen küçük MusicGen modelini kullanacaksın.
pipeline modülü yüklendi ve soundfile kütüphanesi sf olarak kullanılabilir.
Bu egzersiz, kursun bir parçasıdır
Hugging Face ile Multi-Modal Modeller
Egzersiz talimatları
- PyTorch çerçevesinde
facebook/musicgen-smallmodelini kullanarak birtext-to-audiopipeline'ı yükle. - Oluşturma sıcaklığını
0.8vemax_new_tokensdeğerini1olarak ayarlamak içingenerate_kwargsadlı bir sözlük oluştur. "Classic rock riff"istemini kullanarak bir ses dizisi üret ve oluşturma parametrelerinigenerate_kwargssözlüğünle ayarla.
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")
# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}
# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])