Bắt đầu ngayBắt đầu miễn phí

Text-to-speech (TTS) của OpenAI

Hiện OpenAI cung cấp các mô hình tạo giọng nói tự nhiên từ văn bản đầu vào, gọi là text-to-speech hay TTS. OpenAI cung cấp nhiều giọng đọc để bạn lựa chọn, và cho phép truyền phát (stream) phản hồi ra tệp cục bộ hoặc các ứng dụng phía sau.

Bài tập này là một phần của khóa học

Hệ thống đa phương thức với OpenAI API

Xem khóa học

Hướng dẫn bài tập

  • Tạo yêu cầu text-to-speech cho "Hi! How's your day going?", dùng giọng "ballad".
  • Truyền phát phản hồi ra một tệp .mp3.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
Chỉnh sửa và Chạy Mã