Text-to-speech (TTS) cu OpenAI
OpenAI oferă acum modele pentru generarea unui discurs asemănător celui uman pornind de la un text, cunoscute sub numele de text-to-speech sau TTS. OpenAI pune la dispoziție mai multe voci din care poți alege, oferind și posibilitatea de a transmite răspunsul în fișiere locale sau către aplicații externe.
Acest exercițiu face parte din cursul
Sisteme multi-modale cu API-ul OpenAI
Instrucțiuni pentru exercițiu
- Creează cererea text-to-speech pentru
"Hi! How's your day going?", folosind vocea"ballad". - Transmite răspunsul într-un fișier
.mp3.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")