Import různých datových typů
Soubor seaslug.txt
- obsahuje textovou hlavičku složenou z řetězců
- je oddělený tabulátory.
Tato data představují procentuální podíl larev mořských plžů, které se za určitý časový úsek přeměnily. Více informací najdeš zde.
Kvůli hlavičce by se pokus o přímý import pomocí
np.loadtxt() skončil chybou ValueError s hlášením,
že could not convert string to float. Existují
dva způsoby, jak to řešit: první možností je nastavit argument pro datový typ
dtype na hodnotu str (pro řetězec).
Druhou možností je přeskočit první řádek, jak jsme viděli dříve,
pomocí argumentu skiprows.
Toto cvičení je součástí kurzu
Úvod do importu dat v Pythonu
Pokyny k cvičení
- Dokonči první volání
np.loadtxt()tak, že předášfilejako první argument. - Spusť
print(data[0])a vypiš první prvek poledata. - Dokonči druhé volání
np.loadtxt(). Importovaný soubor je oddělený tabulátory, datový typ jefloata chceš přeskočit první řádek. - Vypiš 10. prvek pole
data_floatdoplněním příkazuprint(). Řiď se předchozím volánímprint(). - Spusť zbytek kódu a vizualizuj data.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Assign filename: file
file = 'seaslug.txt'
# Import file: data
data = np.loadtxt(____, delimiter='\t', dtype=str)
# Print the first element of data
print(data[0])
# Import file as floats and skip the first row: data_float
data_float = np.loadtxt(____, delimiter='____', dtype=____, skiprows=____)
# Print the 10th element of data_float
print(____)
# Plot a scatterplot of the data
plt.scatter(data_float[:, 0], data_float[:, 1])
plt.xlabel('time (min.)')
plt.ylabel('percentage of larvae')
plt.show()