OpenAI का text-to-speech (TTS)
OpenAI अब ऐसे मॉडल देता है जो टेक्स्ट इनपुट से इंसान-जैसी आवाज़ बना सकते हैं, जिन्हें text-to-speech या TTS कहा जाता है. OpenAI कई आवाज़ें चुनने के लिए उपलब्ध कराता है, और रिस्पॉन्स को लोकल फ़ाइलों या डाउनस्ट्रीम एप्लिकेशंस तक स्ट्रीम करने की सुविधा भी देता है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
OpenAI API के साथ मल्टी-मॉडल सिस्टम
अभ्यास निर्देश
"Hi! How's your day going?"के लिए text-to-speech रिक्वेस्ट बनाएँ,"ballad"वॉइस का उपयोग करते हुए.- रिस्पॉन्स को
.mp3फ़ाइल में स्ट्रीम करें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")