Text-to-speech (TTS) de OpenAI
OpenAI ahora ofrece modelos para crear voz humana a partir de texto, lo que se conoce como text-to-speech o TTS. OpenAI ofrece varias voces entre las que puedes elegir y permite enviar el audio generado por streaming a archivos locales o a aplicaciones de destino.
Este ejercicio forma parte del curso
Sistemas multimodales con la API de OpenAI
Instrucciones del ejercicio
- Crea la solicitud de text-to-speech para
"Hi! How's your day going?", usando la voz"ballad". - Envía la respuesta por streaming a un archivo
.mp3.
ejercicio interactivo práctico
Prueba este ejercicio completando este código de ejemplo.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")