Předávání keyword argumentů
V tomto cvičení se naučíš, jak předávat keyword argumenty funkcím modelu při použití uvnitř pipeline.
Budeš přitom pracovat s malým modelem MusicGen od Mety, který dokáže generovat hudební ukázky na základě textových popisů nebo zvukových promptů.
Modul pipeline je již načtený a knihovna soundfile je dostupná jako sf.
Toto cvičení je součástí kurzu
Multi-Modal Models with Hugging Face
Pokyny k cvičení
- Načti pipeline
text-to-audios modelemfacebook/musicgen-smallve frameworku PyTorch. - Vytvoř slovník
generate_kwargs, který nastaví teplotu generování na0.8amax_new_tokensna1. - Vygeneruj zvukové pole pomocí promptu
"Classic rock riff"a uprav parametry generování svým slovníkemgenerate_kwargs.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")
# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}
# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])