Kroky datového pipeline
Jako hlavní datový inženýr ve vydavatelství Sierra Publishing tě spolu s tvým týmem pověřili úkolem vyčistit data s recenzemi knih a připravit je jako analytický dataset pro analytiky a datové vědce.
Protože každý den přijímají data od různých partnerů z oblasti vydavatelství, je potřeba vytvořit automatizovaný a spolehlivý datový pipeline pro interní uživatele dat.
Toto cvičení je součástí kurzu
Databricks Concepts
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení