OpenAI 的文本转语音(TTS)
OpenAI 现已提供可将文本输入合成为类人语音的模型,即文本转语音(text-to-speech,TTS)。OpenAI 提供多种可选的发音人,并支持将响应流式传输到本地文件或下游应用。
本练习是课程的一部分
使用 OpenAI API 的多模态系统
练习说明
- 为
"Hi! How's your day going?"创建文本转语音请求,使用"ballad"发音。 - 将响应流式写入一个
.mp3文件。
交互式实操练习
通过完成这段示例代码来试试这个练习。
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")