开始使用免费开始使用

OpenAI 的文本转语音(TTS)

OpenAI 现已提供可将文本输入合成为类人语音的模型,即文本转语音(text-to-speech,TTS)。OpenAI 提供多种可选的发音人,并支持将响应流式传输到本地文件或下游应用。

本练习是课程的一部分

使用 OpenAI API 的多模态系统

查看课程

练习说明

  • "Hi! How's your day going?" 创建文本转语音请求,使用 "ballad" 发音。
  • 将响应流式写入一个 .mp3 文件。

交互式实操练习

通过完成这段示例代码来试试这个练习。

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
编辑并运行代码