or
Cette activité fait partie du cours
Dans ce premier chapitre, vous plongerez dans l'univers de l'ingénierie des données! Découvrez les différences entre un ingénieur de données et un scientifique des données, obtenez un aperçu des divers outils utilisés par les ingénieurs de données et voyez comment l'infonuagique joue un rôle clé en ingénierie des données.
Maintenant que vous connaissez les principales différences entre un ingénieur de données et un scientifique des données, explorez la boîte à outils de l'ingénieur de données! Apprenez en détail les différents types de bases de données qu'utilisent les ingénieurs de données, pourquoi le calcul parallèle est un pilier de leur trousse d'outils, et comment planifier des traitements de données à l'aide de cadres de planification.
Après avoir vu la boîte à outils des ingénieurs de données, il est temps d'aborder le cœur du flux de travail d'un ingénieur de données! Avec l'ETL, vous apprendrez à extraire des données brutes de diverses sources, à transformer ces données en informations exploitables, puis à les charger dans les bases de données pertinentes, prêtes à être utilisées!
Exercice en cours
Couronnez tout ce que vous avez appris dans les trois chapitres précédents en réalisant un cas d'utilisation réel provenant de DataCamp! Vous exécuterez et planifierez un processus ETL qui transforme des évaluations de cours brutes en recommandations de cours exploitables pour les étudiantes et étudiants de DataCamp!