Scalanie danych za pomocą PySpark
W tym ćwiczeniu wgrasz trzy pliki do lakehouse, reprezentujące wymiar gier wideo w schemacie płatka śniegu: gry wideo w jednym pliku, gatunki w drugim, a wydawcy w trzecim. Celem jest scalenie tych danych w jedną tabelę przy użyciu PySpark i funkcji join.
Uwaga: jeśli pojawi się błąd dotyczący limitu żądań API, zazwyczaj oznacza to, że poprzednie zadanie Fabric nie zostało jeszcze ukończone. Aktywne zadania Fabric możesz podejrzeć na stronie Monitor (dostępnej w lewym menu pionowym). Anulowanie starych zadań na stronie Monitor z reguły rozwiązuje ten problem.
To ćwiczenie jest częścią kursu
Przekształcanie i analizowanie danych w Microsoft Fabric
Interaktywne ćwiczenie praktyczne
Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń
Rozpocznij ćwiczenie