การถอดเสียงบทสนทนาทางโทรศัพท์
ในแบบฝึกหัดนี้ เราจะถอดเสียงไฟล์ออดิโอที่แปลงเป็นรูปแบบ .wav แล้วให้เป็นข้อความ โดยใช้ฟังก์ชัน transcribe_audio()
เนื่องจากมีไฟล์จำนวนมากและอาจมีเพิ่มขึ้นอีก เราจึงจะสร้างฟังก์ชัน create_test_list() ที่รับรายการชื่อไฟล์ออดิโอเป็น input แล้ววนซ้ำผ่านแต่ละไฟล์เพื่อถอดเสียงเป็นข้อความ
create_test_list() ใช้ฟังก์ชัน transcribe_audio() ที่เราสร้างไว้ก่อนหน้า และคืนค่าเป็นรายการของสตริงที่มีข้อความที่ถอดเสียงได้จากแต่ละไฟล์ออดิโอ
pre_purchase_wav_files และ post_purchase_wav_files คือรายการชื่อไฟล์ที่เป็นตัวอย่างเสียง
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Spoken Language Processing ด้วย Python
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
def create_text_list(folder):
# Create empty list
text_list = []
# Go through each file
for file in folder:
# Make sure the file is .wav
if file.endswith(".wav"):
print(f"Transcribing file: {file}...")
# Transcribe audio and append text to list
text_list.append(____(file))
return ____
create_text_list(folder)