Hledání mezer v obou DataFramech
Při kontrole kvality dat chceš vidět všechny řádky z obou DataFramů – ubytování bez benchmarků i benchmarky bez ubytování. To ti pomůže odhalit mezery ještě před samotnou analýzou.
polars je načtený jako pl a DataFramy hotels a type_benchmarks máš k dispozici.
Toto cvičení je součástí kurzu
Data Transformation with Polars
Pokyny k cvičení
- Spoj
hotelsstype_benchmarkspodle sloupcůtypeabeachtak, aby byly zachovány všechny řádky z obou DataFramů. - Použij
coalesce=True, aby se zabránilo duplicitním sloupcům joinu.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Keep all rows from both DataFrames
full_view = hotels.____(
type_benchmarks,
on=["type", "beach"],
how="____",
# Avoid duplicate columns
coalesce=____
)
print(full_view.head())