Příprava dat pro analýzu nákupního košíku
V průběhu tohoto kurzu se budeš setkávat s daty ve dvou základních formátech: jako pandas DataFrame nebo jako seznam seznamů. DataFrame objekty vznikají načtením CSV souboru pomocí pandas. Obsahují jediný sloupec, kde každý prvek tvoří řetězec položek z jedné transakce oddělených čárkou, jak ukazuje tabulka níže.
V tomto cvičení si procvičíš načtení dat z CSV souboru a jejich přípravu ve formátu seznamu seznamů. Cesta k datasetu obchodu s potravinami je již definovaná a dostupná jako groceries_path.
| Transaction |
|---|
| 'milk,bread,biscuit' |
| 'bread,milk,biscuit,cereal' |
| … |
| 'tea,milk,coffee,cereal' |
Toto cvičení je součástí kurzu
Market Basket Analysis v Pythonu
Pokyny k cvičení
- Importuj balíček
pandaspod aliasempd. - Pomocí pandas načti CSV soubor na cestě určené proměnnou
groceries_path. - Vyber sloupec
Transactionz DataFrame a rozděl každý řetězec položek oddělených čárkou na seznam. - Převeď DataFrame transakcí na seznam seznamů.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import pandas under the alias pd
import ____ as pd
# Load transactions from pandas
groceries = pd.____(groceries_path)
# Split transaction strings into lists
transactions = groceries['____'].apply(lambda t: t.split(','))
# Convert DataFrame column into list of strings
transactions = list(____)
# Print the list of transactions
print(transactions)