EmpezarEmpieza gratis

Text-to-speech (TTS) de OpenAI

OpenAI ahora ofrece modelos para crear voz humana a partir de texto, lo que se conoce como text-to-speech o TTS. OpenAI ofrece varias voces entre las que puedes elegir y permite enviar el audio generado por streaming a archivos locales o a aplicaciones de destino.

Este ejercicio forma parte del curso

Sistemas multimodales con la API de OpenAI

Ver curso

Instrucciones del ejercicio

  • Crea la solicitud de text-to-speech para "Hi! How's your day going?", usando la voz "ballad".
  • Envía la respuesta por streaming a un archivo .mp3.

ejercicio interactivo práctico

Prueba este ejercicio completando este código de ejemplo.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
Editar y ejecutar código