Transmiterea argumentelor cheie
În acest exercițiu vei învăța cum să transmiți argumente cheie funcțiilor unui model atunci când acestea sunt utilizate într-un pipeline.
Vei folosi modelul mic MusicGen de la Meta, capabil să genereze mostre muzicale pe baza unor descrieri text sau a unor prompturi audio.
Modulul pipeline a fost încărcat, iar biblioteca soundfile este disponibilă ca sf.
Acest exercițiu face parte din cursul
Modele Multi-Modale cu Hugging Face
Instrucțiuni pentru exercițiu
- Încarcă un pipeline
text-to-audiofolosind modelulfacebook/musicgen-smallîn framework-ul PyTorch. - Creează un dicționar numit
generate_kwargspentru a seta temperatura de generare la0.8șimax_new_tokensla1. - Generează un array audio folosind promptul
"Classic rock riff", ajustând parametrii de generare cu dicționarulgenerate_kwargs.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")
# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}
# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])