CommencezCommencez gratuitement

Analyser la distribution des données

Beaucoup de gestionnaires de produit sont à l'aise d'explorer les données liées aux fonctionnalités dont ils ont la responsabilité. Dans ce scénario, vous êtes un gestionnaire de produit à l'aise avec les données et vous vous occupez du fil d'actualité d'une application de médias sociaux. Vous soupçonnez que votre infrastructure de collecte des données du fil d'actualité présente un problème de données anormales. Le nombre moyen de vues par article et par période d'échantillonnage est fortement biaisé à la hausse par rapport au nombre de vues typique.

Vous commencez par examiner le comportement de lecture des cinq meilleurs articles sur une période de rapport d'une semaine afin d'avoir un aperçu du comportement de lecture pour cinq articles populaires mais autrement typiques.

Les tables dc_news_dim et dc_news_fact sont à votre disposition.

Cette activité fait partie du cours

Analyse de séries chronologiques dans PostgreSQL

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

-- Calculate the max, average, and continuous median views
SELECT
  ___ AS max,
  ___ AS average,
  ___ AS median
FROM dc_news_fact;
Modifier et exécuter le code