Méthodes standard des DataFrame
On vous fournit l'ensemble de données diabetes, qui contient des informations sur des patientes ayant subi un test de dépistage du diabète. Vous allez vous concentrer sur le taux de glucose sanguin et les résultats du test. Les personnes dont le test est positif ont généralement un taux de glucose sanguin plus élevé après avoir passé ce qu'on appelle l'épreuve d'hyperglycémie provoquée. Votre tâche est de vérifier si c'est bien le cas pour cet ensemble de données.
La colonne plasma glucose correspond aux taux de glucose. La colonne test result correspond aux résultats du test de dépistage du diabète.
Vous devez utiliser les méthodes standard de DataFrame (le module numpy n'est pas importé pour vous).
Cette activité fait partie du cours
S'entraîner aux questions d'entrevue de programmation en Python
Instructions de l’exercice
- Chargez les données à partir du fichier
diabetes.csv. - Calculez le taux moyen de glucose dans l'ensemble des données.
- Regroupez les données selon les résultats du test de dépistage du diabète.
- Calculez le taux moyen de glucose par groupe.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Load the data from the diabetes.csv file
diabetes = ____
print(diabetes.info())
# Calculate the mean glucose level in the entire dataset
print(____)
# Group the data according to the diabetes test results
diabetes_grouped = ____
# Calculate the mean glucose levels per group
print(____)