Eerste verkenning van de data
Je krijgt data uit het Occupational Employment Statistics (OES)-programma, dat jaarlijks schattingen van werkgelegenheid en lonen publiceert. Deze data bevat het jaarlijkse gemiddelde inkomen van 2001 tot en met 2016 voor 22 beroepsgroepen. Je wilt deze data gebruiken om clusters van beroepen te vinden met vergelijkbare inkomensontwikkelingen.
De data staat in je omgeving als de data.matrix oes.
Voordat je deze data gaat clusteren, moet je bepalen of er pre-processing stappen (zoals schalen en imputatie) nodig zijn.
Gebruik de functies head() en summary() om de oes-data te verkennen en te bepalen welke van de onderstaande pre-processing stappen nodig zijn:
Deze oefening maakt deel uit van de cursus
Clusteranalyse in R
Interactieve oefening met praktijkervaring
Zet theorie om in actie met een van onze interactieve oefeningen
Begin oefening