Text-to-speech (TTS) dari OpenAI
OpenAI kini menyediakan model untuk membuat ucapan yang menyerupai manusia dari masukan teks, yang disebut text-to-speech atau TTS. OpenAI menyediakan beberapa suara yang dapat Anda pilih, dan mereka juga menyediakan kemampuan untuk melakukan streaming respons ke file lokal atau aplikasi hilir.
Latihan ini merupakan bagian dari kursus
Sistem Multi-Modal dengan OpenAI API
Instruksi latihan
- Buat permintaan text-to-speech untuk
"Hi! How's your day going?", menggunakan suara"ballad". - Streaming respons ke file
.mp3.
Latihan interaktif langsung praktik
Cobalah latihan ini dengan melengkapi kode contoh ini.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")