Začněte nyníZačněte zdarma

Hledání mezer v obou DataFramech

Při kontrole kvality dat chceš vidět všechny řádky z obou DataFramů – ubytování bez benchmarků i benchmarky bez ubytování. To ti pomůže odhalit mezery ještě před samotnou analýzou.

polars je načtený jako pl a DataFramy hotels a type_benchmarks máš k dispozici.

Toto cvičení je součástí kurzu

Data Transformation with Polars

Zobrazit kurz

Pokyny k cvičení

  • Spoj hotels s type_benchmarks podle sloupců type a beach tak, aby byly zachovány všechny řádky z obou DataFramů.
  • Použij coalesce=True, aby se zabránilo duplicitním sloupcům joinu.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Keep all rows from both DataFrames
full_view = hotels.____(
    type_benchmarks,
    on=["type", "beach"],
    how="____",
    # Avoid duplicate columns
    coalesce=____
)

print(full_view.head())
Upravit a spustit kód