CommencerCommencez gratuitement

Text-to-speech (TTS) d’OpenAI

OpenAI propose désormais des modèles capables de générer une voix naturelle à partir d’un texte : c’est le text-to-speech, ou TTS. OpenAI propose plusieurs voix parmi lesquelles choisir, et permet aussi de diffuser la réponse vers des fichiers locaux ou des applications en aval.

Cet exercice fait partie du cours

<cours>Systèmes multimodaux avec l’API OpenAI</cours>
Voir le cours

Instructions de l’exercice

  • Créez la requête de text-to-speech pour "Hi! How's your day going?", en utilisant la voix "ballad".
  • Diffusez la réponse dans un fichier .mp3.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
Modifier et exécuter le code