Standaardmethoden voor DataFrames
Je krijgt de diabetes-gegevensset met informatie over vrouwelijke patiënten die op diabetes zijn getest. Je richt je op de bloedsuikerspiegels en de testresultaten. Personen met een positieve test hebben meestal hogere bloedsuikerspiegels na de zogenoemde glucosetolerantietest. Je taak is om te onderzoeken of dat in deze specifieke gegevensset ook zo is.
De kolom plasma glucose bevat de glucosespiegels. De kolom test result bevat de uitslagen van de diabetesstest.
Je moet standaardmethoden van DataFrames gebruiken (de module numpy is niet voor je geïmporteerd).
Deze oefening maakt deel uit van de cursus
Oefenen met coding-interviewvragen in Python
Oefeninstructies
- Laad de gegevens uit het bestand
diabetes.csv. - Bereken het gemiddelde glucosegehalte in de hele gegevensset.
- Groepeer de gegevens op basis van de uitslagen van de diabetestest.
- Bereken de gemiddelde glucosegehaltes per groep.
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Load the data from the diabetes.csv file
diabetes = ____
print(diabetes.info())
# Calculate the mean glucose level in the entire dataset
print(____)
# Group the data according to the diabetes test results
diabetes_grouped = ____
# Calculate the mean glucose levels per group
print(____)