Zacznij terazZacznij za darmo

Zamiana tekstu na mowę (TTS) w OpenAI

OpenAI udostępnia teraz modele do generowania naturalnie brzmiącej mowy na podstawie tekstu – to właśnie technologia zamiany tekstu na mowę, czyli TTS. OpenAI oferuje kilka głosów do wyboru, a także możliwość przesyłania strumieniowego odpowiedzi do lokalnych plików lub innych aplikacji.

To ćwiczenie jest częścią kursu

Systemy multimodalne z OpenAI API

Zobacz kurs

Instrukcje do ćwiczenia

  • Utwórz żądanie zamiany tekstu na mowę dla "Hi! How's your day going?", używając głosu "ballad".
  • Prześlij odpowiedź strumieniowo do pliku .mp3.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
Edytuj i uruchom kod