การถอดเสียงภาษาที่ไม่ใช่ภาษาอังกฤษ
โมเดลเสียงของ OpenAI ไม่ได้ถอดเสียงภาษาอังกฤษเพียงอย่างเดียว แต่ยังรองรับเสียงพูดในหลากหลายภาษาได้อีกด้วย
ในแบบฝึกหัดนี้ จะสร้างการถอดเสียงจากไฟล์ audio.m4a ซึ่งบันทึกเสียงพูดภาษาโปรตุเกส
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
ระบบ Multi-Modal ด้วย OpenAI API
คำแนะนำการฝึกหัด
- เปิดไฟล์
audio.m4aในโหมดอ่านแบบไบนารี (read-binary) - ส่งคำขอถอดเสียงไปยัง Audio endpoint
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
client = OpenAI(api_key="")
# Open the audio.m4a file
audio_file = ____("____", "____")
# Create a transcript from the audio file
response = client.audio.transcriptions.____(model="whisper-1", file=____)
print(response.text)