Text-to-speech (TTS) d’OpenAI
OpenAI propose désormais des modèles capables de générer une voix naturelle à partir d’un texte : c’est le text-to-speech, ou TTS. OpenAI propose plusieurs voix parmi lesquelles choisir, et permet aussi de diffuser la réponse vers des fichiers locaux ou des applications en aval.
Cet exercice fait partie du cours
<cours>Systèmes multimodaux avec l’API OpenAI</cours>Instructions de l’exercice
- Créez la requête de text-to-speech pour
"Hi! How's your day going?", en utilisant la voix"ballad". - Diffusez la réponse dans un fichier
.mp3.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")