Zamiana tekstu na mowę (TTS) w OpenAI
OpenAI udostępnia teraz modele do generowania naturalnie brzmiącej mowy na podstawie tekstu – to właśnie technologia zamiany tekstu na mowę, czyli TTS. OpenAI oferuje kilka głosów do wyboru, a także możliwość przesyłania strumieniowego odpowiedzi do lokalnych plików lub innych aplikacji.
To ćwiczenie jest częścią kursu
Systemy multimodalne z OpenAI API
Instrukcje do ćwiczenia
- Utwórz żądanie zamiany tekstu na mowę dla
"Hi! How's your day going?", używając głosu"ballad". - Prześlij odpowiedź strumieniowo do pliku
.mp3.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
client = OpenAI(api_key="")
# Create the text-to-speech request
response = client.audio.speech.create(
model="gpt-4o-mini-tts",
____,
input="Hi! How's your day going?"
)
# Stream the response to an MP3 file
response.____("output.mp3")