Kom igångKom igång gratis

OpenAI:s text-till-tal (TTS)

OpenAI erbjuder nu modeller för att skapa mänskligt klingande tal från textinmatning – så kallat text-till-tal eller TTS. OpenAI tillhandahåller flera röster att välja bland, och det finns möjlighet att strömma svaret till lokala filer eller vidare till andra applikationer.

Den här övningen är en del av kursen

Multimodala system med OpenAI API

Visa kurs

Övningsinstruktioner

  • Skapa text-till-tal-förfrågan för "Hi! How's your day going?", med rösten "ballad".
  • Strömma svaret till en .mp3-fil.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
Redigera och kör kod