Zacznij terazZacznij za darmo

Scalanie danych za pomocą PySpark

W tym ćwiczeniu wgrasz trzy pliki do lakehouse, reprezentujące wymiar gier wideo w schemacie płatka śniegu: gry wideo w jednym pliku, gatunki w drugim, a wydawcy w trzecim. Celem jest scalenie tych danych w jedną tabelę przy użyciu PySpark i funkcji join.

Uwaga: jeśli pojawi się błąd dotyczący limitu żądań API, zazwyczaj oznacza to, że poprzednie zadanie Fabric nie zostało jeszcze ukończone. Aktywne zadania Fabric możesz podejrzeć na stronie Monitor (dostępnej w lewym menu pionowym). Anulowanie starych zadań na stronie Monitor z reguły rozwiązuje ten problem.

To ćwiczenie jest częścią kursu

Przekształcanie i analizowanie danych w Microsoft Fabric

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń

Rozpocznij ćwiczenie