開始使用免費開始

使用 PyDub 正規化音訊檔

有時候音訊檔會出現一段講話很大聲、另一段又很小聲的情況。音量落差太大會影響轉錄的品質。

所幸,PyDub 的 effects 模組提供 normalize() 函式,會先找出 AudioSegment 的最大音量,接著將其餘部分按比例調整。也就是說,原本小聲的段落會被提升音量。

你可以在這裡聆聽一個先大聲後變小聲的範例音檔 loud_then_quiet.wavhere

在本練習中,你會使用 normalize() 來正規化這個檔案的音量,讓它聽起來更接近這個效果

本練習屬於課程

Python 的口語語言處理

檢視課程

練習說明

  • PyDub 匯入 AudioSegment,並從 PyDub 的 effects 模組匯入 normalize
  • 匯入目標音訊檔 loud_then_quiet.wav,並將其存成 loud_then_quiet
  • 使用 normalize() 函式正規化匯入的音訊檔,並將結果存成 normalized_loud_then_quiet

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Import AudioSegment and normalize
from pydub import ____
from pydub.effects import ____

# Import target audio file
loud_then_quiet = AudioSegment.from_file(____)

# Normalize target audio file
normalized_loud_then_quiet = ____(____)
編輯並執行程式碼