ÎncepețiÎncepe gratuit

Transmiterea argumentelor cheie

În acest exercițiu vei învăța cum să transmiți argumente cheie funcțiilor unui model atunci când acestea sunt utilizate într-un pipeline.

Vei folosi modelul mic MusicGen de la Meta, capabil să genereze mostre muzicale pe baza unor descrieri text sau a unor prompturi audio.

Modulul pipeline a fost încărcat, iar biblioteca soundfile este disponibilă ca sf.

Acest exercițiu face parte din cursul

Modele Multi-Modale cu Hugging Face

Vezi cursul

Instrucțiuni pentru exercițiu

  • Încarcă un pipeline text-to-audio folosind modelul facebook/musicgen-small în framework-ul PyTorch.
  • Creează un dicționar numit generate_kwargs pentru a seta temperatura de generare la 0.8 și max_new_tokens la 1.
  • Generează un array audio folosind promptul "Classic rock riff", ajustând parametrii de generare cu dicționarul generate_kwargs.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")

# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}

# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])
Editează și rulează codul