Implementace denormalizace dat
Ve většině případů by měly být tabulky dimenzí denormalizované. V tomto cvičení použijeme PySpark k načtení dvou tabulek dimenzí – products a categories – a denormalizujeme tabulku produktů tak, že sloupec categoryID nahradíme odpovídajícím categoryName z tabulky categories.
Poznámka: Pokud se zobrazí chyba týkající se limitu volání API, bývá to způsobeno tím, že předchozí úloha v Fabric ještě neskončila. Aktivní úlohy Fabric si můžeš prohlédnout na stránce Monitor (nachází se v levém svislém menu). Zrušení starých úloh na stránce Monitor tento problém většinou vyřeší.
Toto cvičení je součástí kurzu
Transform and Analyze Data with Microsoft Fabric
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení