Wdrożenie potoku ETL na Kubernetes
Wdrożysz potok ETL na Kubernetes. Kroki Extract, Transform i Load zostaną zrealizowane przez Pody, które odczytują dane z odpowiednich Persistent Volumes i zapisują do nich dane tworzone przez Persistent Volume Claims.
Twoim zadaniem jest znalezienie łącznej liczby pasażerów, którzy podróżowali nowojorską żółtą taksówką w grupach liczących co najmniej 2 osoby. „Extract Pod" przygotuje dane wejściowe jako plik CSV i przekaże je do „Transform Pod". Ten Pod przetworzy dane dotyczące żółtych taksówek do bazy danych SQLite, wybierze wszystkie dane niezbędne do końcowego obliczenia i przekaże je do „Load Pod". Ten ostatni Pod zsumuje dane o pasażerach, wyświetli wynik i zapisze go jako plik CSV.
Wszystkie te kroki zostaną wykonane przy użyciu standardowych obiektów Kubernetes, które już znasz. Przygotowano dwa katalogi:
"Docker/" i "Manifests/", które zawierają pliki niezbędne do tworzenia obrazów Docker i wdrażania ich za pomocą Kubernetes.
To ćwiczenie jest częścią kursu
Wprowadzenie do Kubernetes
Interaktywne ćwiczenie praktyczne
Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń
Rozpocznij ćwiczenie