เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

การแปลงข้อความเป็นเสียง (TTS) ด้วย OpenAI

ปัจจุบัน OpenAI มีโมเดลสำหรับสร้างเสียงพูดที่ฟังดูเป็นธรรมชาติจากข้อความ ซึ่งเรียกว่า text-to-speech หรือ TTS OpenAI มีเสียงให้เลือกหลายแบบ และรองรับการสตรีมผลลัพธ์ไปยังไฟล์ในเครื่องหรือแอปพลิเคชันอื่นได้โดยตรง

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

ระบบ Multi-Modal ด้วย OpenAI API

ดูคอร์ส

คำแนะนำการฝึกหัด

  • สร้างคำขอ text-to-speech สำหรับ "Hi! How's your day going?" โดยใช้เสียง "ballad"
  • สตรีมการตอบกลับไปยังไฟล์ .mp3

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
แก้ไขและรันโค้ด