CommencezCommencez gratuitement

La synthèse vocale (TTS) d'OpenAI

OpenAI propose maintenant des modèles qui génèrent une voix naturelle à partir d'un texte, appelés synthèse vocale ou TTS. OpenAI offre plusieurs voix parmi lesquelles choisir et permet de diffuser la réponse vers des fichiers locaux ou des applications en aval.

Cette activité fait partie du cours

Systèmes multimodaux avec l'API d'OpenAI

Voir le cours

Instructions de l’exercice

  • Créez la requête de synthèse vocale pour "Hi! How's your day going?", en utilisant la voix "ballad".
  • Diffusez la réponse dans un fichier .mp3.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
Modifier et exécuter le code