키워드 인수 전달하기
이 연습 문제에서는 파이프라인 내부에서 모델 함수를 사용할 때 키워드 인수를 전달하는 방법을 배워 봅니다.
이를 위해 Meta의 MusicGen small 모델을 사용해 볼 거예요. 이 모델은 텍스트 설명이나 오디오 프롬프트를 기반으로 음악 샘플을 생성할 수 있습니다.
pipeline 모듈이 로드되어 있고, soundfile 라이브러리는 sf로 사용할 수 있습니다.
이 연습은 강의의 일부입니다
Hugging Face로 배우는 멀티모달 모델
연습 안내
- PyTorch 프레임워크에서
facebook/musicgen-small모델을 사용해text-to-audio파이프라인을 로드하세요. - 생성 온도를
0.8,max_new_tokens를1로 설정하는 사전generate_kwargs를 만드세요. "Classic rock riff"프롬프트로 오디오 배열을 생성하고,generate_kwargs사전으로 생성 파라미터를 조정하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")
# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}
# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])