Spoj si to dohromady
Datové pipeline slouží ke zpracování dat. Na konci 1. kapitoly ses seznámil/a s ETL (Extract, Transform, Load) — jedním z frameworků pro tvorbu datových pipeline. Úlohy zpracování dat, které jsi právě probral/a, tomuto frameworku přesně odpovídají: každá patří buď k extrakci, transformaci, nebo načtení dat.
Pozor — ačkoliv „ukládání" a „načítání" obvykle považujeme za protiklady, v kontextu datového inženýrství jde o totéž. Když totiž něco ukládáš, jednoduše to přesuneš do dalšího kroku pipeline.
Dokážeš správně zařadit jednotlivé úlohy zpracování dat jako extrakci, transformaci nebo načtení?
Toto cvičení je součástí kurzu
Understanding Data Engineering
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení