La synthèse vocale (TTS) d'OpenAI
OpenAI propose maintenant des modèles qui génèrent une voix naturelle à partir d'un texte, appelés synthèse vocale ou TTS. OpenAI offre plusieurs voix parmi lesquelles choisir et permet de diffuser la réponse vers des fichiers locaux ou des applications en aval.
Cette activité fait partie du cours
Systèmes multimodaux avec l'API d'OpenAI
Instructions de l’exercice
- Créez la requête de synthèse vocale pour
"Hi! How's your day going?", en utilisant la voix"ballad". - Diffusez la réponse dans un fichier
.mp3.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")