Načtení CSV souboru do tabulky
Zatím ti šlo vkládání dat do tabulek skvěle! Teď se naučíš, jak načíst obsah CSV souboru do tabulky.
Jedna možnost by byla přečíst CSV soubor řádek po řádku, z každého řádku vytvořit slovník a pak použít insert(), jako v předchozím cvičení.
Existuje ale rychlejší způsob pomocí pandas. CSV soubor lze načíst do DataFrame funkcí read_csv() (tuto funkci už znáš, ale pokud si chceš osvěžit paměť, spusť v konzoli help(pd.read_csv)!). Pak můžeš na DataFrame zavolat metodu .to_sql() (dokumentace) a data načíst do SQL tabulky v databázi. Sloupce DataFrame musí odpovídat sloupcům SQL tabulky.
.to_sql() má mnoho parametrů, v tomto cvičení ale použijeme tyto:
nameje název SQL tabulky (jako řetězec).conje připojení k databázi, které použiješ k nahrání dat.if_existsurčuje, jak se má metoda zachovat, pokud tabulka v databázi již existuje; možné hodnoty jsou"fail","replace"a"append".index(TrueneboFalse) určuje, zda se má index DataFrame zapsat jako sloupec.
V tomto cvičení nahraješ data ze souboru census.csv do existující tabulky "census". Připojení connection k databázi už je pro tebe připravené.
Toto cvičení je součástí kurzu
Introduction to Databases in Python
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# import pandas
import pandas as pd
# read census.csv into a DataFrame : census_df
census_df = pd.___(___, ___=___)
# rename the columns of the census DataFrame
census_df.columns = [___, ___, ___, 'pop2000', 'pop2008']