始める無料で始める

ポッドキャストの文字起こしを作成する

OpenAI API の Audio エンドポイントでは、音声認識(speech-to-text)の文字起こしや翻訳に使える各種モデルにアクセスできます。この演習では、OpenAI Developer の Logan Kilpatrick が出演する DataFramed ポッドキャスト のエピソードから文字起こしを作成します。

Logan の話をもっと聴きたい方は、エピソード全文「ChatGPT and the OpenAI Developer Ecosystem」もチェックしてみてください。

この演習はコースの一部です

OpenAI APIで学ぶマルチモーダルシステム

コースを見る

演習の手順

  • openai-audio.mp3 ファイルを開きます。
  • audio_file を使って Audio エンドポイントに文字起こしリクエストを作成します。
  • response から文字起こしテキストを抽出して表示します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

client = OpenAI(api_key="")

# Open the openai-audio.mp3 file
audio_file = ____(____, "rb")

# Create a transcript from the audio file
response = client.audio.transcriptions.____(model="whisper-1", file=____)

# Extract and print the transcript text
print(response.____)
コードを編集して実行