OpenAI 的文字轉語音(TTS)
OpenAI 現在提供模型,能從文字輸入產生近似真人的語音,也就是所謂的文字轉語音或 TTS。OpenAI 提供多種可選的聲線,並支援把回應串流至本機檔案或下游應用程式。
本練習屬於課程
使用 OpenAI API 的多模態系統
練習說明
- 建立
"Hi! How's your day going?"的文字轉語音請求,並使用"ballad"聲線。 - 將回應串流成
.mp3檔。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")