OpenAI의 텍스트-음성 변환(TTS)
OpenAI는 이제 텍스트 입력에서 사람처럼 자연스러운 음성을 생성하는 텍스트-음성 변환, 즉 TTS 모델을 제공합니다. OpenAI는 선택할 수 있는 여러 음성을 제공하며, 응답을 로컬 파일이나 다운스트림 애플리케이션으로 스트리밍할 수 있는 기능도 제공합니다.
이 연습은 강의의 일부입니다
OpenAI API로 만드는 멀티모달 시스템
연습 안내
"ballad"음성을 사용해"Hi! How's your day going?"에 대한 텍스트-음성 변환 요청을 만드세요.- 응답을
.mp3파일로 스트리밍하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")