시작하기무료로 시작하기

키워드 인수 전달하기

이 연습 문제에서는 파이프라인 내부에서 모델 함수를 사용할 때 키워드 인수를 전달하는 방법을 배워 봅니다.

이를 위해 Meta의 MusicGen small 모델을 사용해 볼 거예요. 이 모델은 텍스트 설명이나 오디오 프롬프트를 기반으로 음악 샘플을 생성할 수 있습니다.

pipeline 모듈이 로드되어 있고, soundfile 라이브러리는 sf로 사용할 수 있습니다.

이 연습은 강의의 일부입니다

Hugging Face로 배우는 멀티모달 모델

강의 보기

연습 안내

  • PyTorch 프레임워크에서 facebook/musicgen-small 모델을 사용해 text-to-audio 파이프라인을 로드하세요.
  • 생성 온도를 0.8, max_new_tokens1로 설정하는 사전 generate_kwargs를 만드세요.
  • "Classic rock riff" 프롬프트로 오디오 배열을 생성하고, generate_kwargs 사전으로 생성 파라미터를 조정하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")

# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}

# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])
코드 편집 및 실행