Prozkoumání klasifikačních dat
V těchto posledních cvičeních kapitoly prozkoumáš dvě datové sady, se kterými budeš v tomto kurzu pracovat.
První obsahuje záznamy zvuků srdečního tepu. Srdce obvykle bije v předvídatelném rytmu, ale některé poruchy mohou způsobit, že tep je nepravidelný. Tato datová sada obsahuje trénovací sadu s označenými typy srdečních tepů a testovací sadu bez štítků. Testovací sadu použiješ k ověření svých modelů.
Protože máš k dispozici označená data, je tato sada ideální pro klasifikaci. Ostatně původně byla součástí veřejné soutěže na Kaggle.
Toto cvičení je součástí kurzu
Machine Learning pro data časových řad v Pythonu
Pokyny k cvičení
- Pomocí
globzískej seznam souborů.wavv adresářidata_dir. - Načti první zvukový soubor ze seznamu pomocí
librosa. - Vytvoř časové pole
timepro tato data. - Vykresli průběh vlny pro tento soubor spolu s časovým polem.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
import librosa as lr
from glob import glob
# List all the wav files in the folder
audio_files = ____(data_dir + '/*.wav')
# Read in the first audio file, create the time array
audio, sfreq = lr.load(____)
time = np.arange(0, len(audio)) / ____
# Plot audio over time
fig, ax = plt.subplots()
ax.plot(____, ____)
ax.set(xlabel='Time (s)', ylabel='Sound Amplitude')
plt.show()