Текст-в-мовлення (TTS) від OpenAI
OpenAI тепер надає моделі для створення природного мовлення з текстового вводу — так званий текст-в-мовлення або TTS. OpenAI пропонує кілька голосів на вибір і дає змогу передавати відповідь потоком у локальні файли або в інші застосунки.
Ця вправа є частиною курсу
Мультимодальні системи з OpenAI API
Інструкції до вправи
- Створіть запит текст-в-мовлення для
"Hi! How's your day going?", використовуючи голос"ballad". - Передайте відповідь потоком у файл
.mp3.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")