การแปลงข้อความเป็นเสียง (TTS) ด้วย OpenAI
ปัจจุบัน OpenAI มีโมเดลสำหรับสร้างเสียงพูดที่ฟังดูเป็นธรรมชาติจากข้อความ ซึ่งเรียกว่า text-to-speech หรือ TTS OpenAI มีเสียงให้เลือกหลายแบบ และรองรับการสตรีมผลลัพธ์ไปยังไฟล์ในเครื่องหรือแอปพลิเคชันอื่นได้โดยตรง
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
ระบบ Multi-Modal ด้วย OpenAI API
คำแนะนำการฝึกหัด
- สร้างคำขอ text-to-speech สำหรับ
"Hi! How's your day going?"โดยใช้เสียง"ballad" - สตรีมการตอบกลับไปยังไฟล์
.mp3
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")