ポッドキャストの文字起こしを作成する
OpenAI API の Audio エンドポイントでは、音声認識(speech-to-text)の文字起こしや翻訳に使える各種モデルにアクセスできます。この演習では、OpenAI Developer の Logan Kilpatrick が出演する DataFramed ポッドキャスト のエピソードから文字起こしを作成します。
Logan の話をもっと聴きたい方は、エピソード全文「ChatGPT and the OpenAI Developer Ecosystem」もチェックしてみてください。
この演習はコースの一部です
OpenAI APIで学ぶマルチモーダルシステム
演習の手順
openai-audio.mp3ファイルを開きます。audio_fileを使って Audio エンドポイントに文字起こしリクエストを作成します。responseから文字起こしテキストを抽出して表示します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
client = OpenAI(api_key="")
# Open the openai-audio.mp3 file
audio_file = ____(____, "rb")
# Create a transcript from the audio file
response = client.audio.transcriptions.____(model="whisper-1", file=____)
# Extract and print the transcript text
print(response.____)