Začněte nyníZačněte zdarma

Spoj si to dohromady

Datové pipeline slouží ke zpracování dat. Na konci 1. kapitoly ses seznámil/a s ETL (Extract, Transform, Load) — jedním z frameworků pro tvorbu datových pipeline. Úlohy zpracování dat, které jsi právě probral/a, tomuto frameworku přesně odpovídají: každá patří buď k extrakci, transformaci, nebo načtení dat.

Pozor — ačkoliv „ukládání" a „načítání" obvykle považujeme za protiklady, v kontextu datového inženýrství jde o totéž. Když totiž něco ukládáš, jednoduše to přesuneš do dalšího kroku pipeline.

Dokážeš správně zařadit jednotlivé úlohy zpracování dat jako extrakci, transformaci nebo načtení?

Toto cvičení je součástí kurzu

Understanding Data Engineering

Zobrazit kurz

Interaktivní praktické cvičení

Proměňte teorii v praxi s jedním z našich interaktivních cvičení

Začít cvičení