ПочатиПочніть безкоштовно

Текст-в-мовлення (TTS) від OpenAI

OpenAI тепер надає моделі для створення природного мовлення з текстового вводу — так званий текст-в-мовлення або TTS. OpenAI пропонує кілька голосів на вибір і дає змогу передавати відповідь потоком у локальні файли або в інші застосунки.

Ця вправа є частиною курсу

Мультимодальні системи з OpenAI API

Переглянути курс

Інструкції до вправи

  • Створіть запит текст-в-мовлення для "Hi! How's your day going?", використовуючи голос "ballad".
  • Передайте відповідь потоком у файл .mp3.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
Редагувати та запускати код