英語以外の言語を文字起こしする
OpenAI の音声モデルは英語の音声を書き起こせるだけでなく、多くの他言語の音声でも高い性能を発揮します。
この演習では、ポルトガル語の音声を含む audio.m4a からトランスクリプトを作成します。
この演習はコースの一部です
OpenAI APIで学ぶマルチモーダルシステム
演習の手順
audio.m4aファイルをバイナリ読み取り(read-binary)モードで開きます。- Audio エンドポイントに文字起こしのリクエストを作成します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
client = OpenAI(api_key="")
# Open the audio.m4a file
audio_file = ____("____", "____")
# Create a transcript from the audio file
response = client.audio.transcriptions.____(model="whisper-1", file=____)
print(response.text)