ÎncepețiÎncepe gratuit

Text-to-speech (TTS) cu OpenAI

OpenAI oferă acum modele pentru generarea unui discurs asemănător celui uman pornind de la un text, cunoscute sub numele de text-to-speech sau TTS. OpenAI pune la dispoziție mai multe voci din care poți alege, oferind și posibilitatea de a transmite răspunsul în fișiere locale sau către aplicații externe.

Acest exercițiu face parte din cursul

Sisteme multi-modale cu API-ul OpenAI

Vezi cursul

Instrucțiuni pentru exercițiu

  • Creează cererea text-to-speech pentru "Hi! How's your day going?", folosind vocea "ballad".
  • Transmite răspunsul într-un fișier .mp3.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
Editează și rulează codul