Retaildata joinen en aggregeren
Je team bij Global Retail Analytics wil de omzetpatronen per regio begrijpen. Er is een nieuw CSV-bestand country_lookup.csv toegevoegd aan de datasets-volume, waarin elk land is gekoppeld aan zijn regio en valuta.
Je verrijkt de online_retail-data met deze lookup-gegevensset via een broadcast join, controleert het queryplan en aggregeert de omzet per regio.
Deze oefening maakt deel uit van de cursus
Gegevens transformeren met Spark SQL in Databricks
Interactieve oefening met praktijkervaring
Zet theorie om in actie met een van onze interactieve oefeningen
Begin oefening