Kontrollera klassimbalans
2022 Kaggle Survey samlar information om datavetares bakgrund, föredragna tekniker och metoder. Den anses ge en rättvisande bild av vad som händer inom datavetenskap, tack vare det stora antalet svarande och deras profiler.
Efter att ha granskat jobbtitlarna och kategoriserat dem för att matcha vår salaries-DataFrame kan du se följande fördelning av jobbkategorier i Kaggle-undersökningen:
| Jobbkategori | Relativ frekvens |
|---|---|
| Data Science | 0,281236 |
| Data Analytics | 0,224231 |
| Other | 0,214609 |
| Managerial | 0,121300 |
| Machine Learning | 0,083248 |
| Data Engineering | 0,075375 |
Betrakta Kaggle-undersökningens resultat som populationen. Din uppgift är att undersöka om salaries-DataFrame är representativ genom att jämföra den relativa frekvensen för jobbkategorierna.
Den här övningen är en del av kursen
Exploratory Data Analysis i Python
Övningsinstruktioner
- Skriv ut den relativa frekvensen för kolumnen
"Job_Category"isalaries-DataFrame.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Print the relative frequency of Job_Category
print(____)