开始使用免费开始使用

传递关键字参数

在本练习中,您将学习当模型函数在 pipeline 中使用时,如何传递关键字参数。

为此,您将使用 Meta 的小型 MusicGen 模型。它可以根据文本描述或音频提示生成音乐片段。

pipeline 模块已加载,soundfile 库可通过 sf 使用。

本练习是课程的一部分

使用 Hugging Face 的多模态模型

查看课程

练习说明

  • 使用 PyTorch 框架,加载 facebook/musicgen-small 模型的 text-to-audio pipeline。
  • 创建名为 generate_kwargs 的字典,将生成温度设为 0.8,并将 max_new_tokens 设为 1
  • 使用提示词 "Classic rock riff" 生成音频数组,并用您的 generate_kwargs 字典调整生成参数。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Load a text-to-audio pipeline
musicgen = pipeline(task="____", model="____", framework="pt")

# Make a dictionary to set the generation temperature to 0.8 and max_new_tokens to 1
generate_kwargs = {"____": ____, "____": ____}

# Generate an audio array passing the arguments
outputs = ____("____", ____=____)
sf.write("output.wav", outputs["audio"][0][0], outputs["sampling_rate"])
编辑并运行代码