Analyser la distribution des données
De nombreux product managers savent explorer les données liées aux fonctionnalités dont ils sont responsables. Dans ce scénario, vous êtes un product manager à l’aise avec les données, en charge du fil d’actualités d’une application de réseau social. Vous soupçonnez que l’infrastructure de collecte des données du fil d’actualités présente un problème de données anormales. Le nombre moyen de vues par article et par période d’échantillonnage est fortement biaisé à la hausse par rapport au nombre de vues typique.
Vous commencez par examiner le comportement de lecture des cinq meilleurs articles sur une période de reporting d’une semaine, afin d’avoir une idée de ce à quoi ressemble la lecture pour cinq articles populaires mais par ailleurs typiques.
Les tables dc_news_dim et dc_news_fact sont à votre disposition.
Cet exercice fait partie du cours
<cours>Analyse des séries temporelles dans PostgreSQL</cours>Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
-- Calculate the max, average, and continuous median views
SELECT
___ AS max,
___ AS average,
___ AS median
FROM dc_news_fact;