Text-to-speech (TTS) của OpenAI
Hiện OpenAI cung cấp các mô hình tạo giọng nói tự nhiên từ văn bản đầu vào, gọi là text-to-speech hay TTS. OpenAI cung cấp nhiều giọng đọc để bạn lựa chọn, và cho phép truyền phát (stream) phản hồi ra tệp cục bộ hoặc các ứng dụng phía sau.
Bài tập này là một phần của khóa học
Hệ thống đa phương thức với OpenAI API
Hướng dẫn bài tập
- Tạo yêu cầu text-to-speech cho
"Hi! How's your day going?", dùng giọng"ballad". - Truyền phát phản hồi ra một tệp
.mp3.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")