시작하기무료로 시작하기

OpenAI의 텍스트-음성 변환(TTS)

OpenAI는 이제 텍스트 입력에서 사람처럼 자연스러운 음성을 생성하는 텍스트-음성 변환, 즉 TTS 모델을 제공합니다. OpenAI는 선택할 수 있는 여러 음성을 제공하며, 응답을 로컬 파일이나 다운스트림 애플리케이션으로 스트리밍할 수 있는 기능도 제공합니다.

이 연습은 강의의 일부입니다

OpenAI API로 만드는 멀티모달 시스템

강의 보기

연습 안내

  • "ballad" 음성을 사용해 "Hi! How's your day going?"에 대한 텍스트-음성 변환 요청을 만드세요.
  • 응답을 .mp3 파일로 스트리밍하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

client = OpenAI(api_key="")

# Create the text-to-speech request
response = client.audio.speech.create(
  model="gpt-4o-mini-tts",
  ____,
  input="Hi! How's your day going?"
)

# Stream the response to an MP3 file
response.____("output.mp3")
코드 편집 및 실행