传递关键字参数
在本练习中,您将学习当模型函数在 pipeline 中使用时,如何传递关键字参数。
为此,您将使用 Meta 的小型 MusicGen 模型。它可以根据文本描述或音频提示生成音乐片段。
pipeline 模块已加载,soundfile 库可通过 sf 使用。
本练习是课程的一部分
使用 Hugging Face 的多模态模型
练习说明
- 使用 PyTorch 框架,加载
facebook/musicgen-small模型的text-to-audiopipeline。 - 创建名为
generate_kwargs的字典,将生成温度设为0.8,并将max_new_tokens设为1。 - 使用提示词
"Classic rock riff"生成音频数组,并用您的generate_kwargs字典调整生成参数。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")
# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}
# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])