Začněte nyníZačněte zdarma

Načtení CSV souboru do tabulky

Zatím ti šlo vkládání dat do tabulek skvěle! Teď se naučíš, jak načíst obsah CSV souboru do tabulky.

Jedna možnost by byla přečíst CSV soubor řádek po řádku, z každého řádku vytvořit slovník a pak použít insert(), jako v předchozím cvičení.

Existuje ale rychlejší způsob pomocí pandas. CSV soubor lze načíst do DataFrame funkcí read_csv() (tuto funkci už znáš, ale pokud si chceš osvěžit paměť, spusť v konzoli help(pd.read_csv)!). Pak můžeš na DataFrame zavolat metodu .to_sql() (dokumentace) a data načíst do SQL tabulky v databázi. Sloupce DataFrame musí odpovídat sloupcům SQL tabulky.

.to_sql() má mnoho parametrů, v tomto cvičení ale použijeme tyto:

  • name je název SQL tabulky (jako řetězec).
  • con je připojení k databázi, které použiješ k nahrání dat.
  • if_exists určuje, jak se má metoda zachovat, pokud tabulka v databázi již existuje; možné hodnoty jsou "fail", "replace" a "append".
  • index (True nebo False) určuje, zda se má index DataFrame zapsat jako sloupec.

V tomto cvičení nahraješ data ze souboru census.csv do existující tabulky "census". Připojení connection k databázi už je pro tebe připravené.

Toto cvičení je součástí kurzu

Introduction to Databases in Python

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# import pandas
import pandas as pd

# read census.csv into a DataFrame : census_df
census_df = pd.___(___, ___=___)

# rename the columns of the census DataFrame
census_df.columns = [___, ___, ___, 'pop2000', 'pop2008']
Upravit a spustit kód