Erste Erkundung der Daten
Dir liegen Daten aus dem Occupational Employment Statistics (OES) Programm vor, das jährlich Schätzungen zu Beschäftigung und Löhnen erstellt. Diese Daten enthalten das jährliche Durchschnittseinkommen von 2001 bis 2016 für 22 Berufsgruppen. Du möchtest diese Daten nutzen, um Cluster von Berufen zu identifizieren, die ähnliche Einkommensverläufe aufweisen.
Die Daten sind in deiner Umgebung als Datenmatrix oes gespeichert.
Bevor du mit dem Clustern beginnst, solltest du prüfen, ob Vorverarbeitungsschritte (wie Skalierung und Imputation) notwendig sind.
Verwende die Funktionen head() und summary(), um die oes-Daten zu untersuchen und festzustellen, welche der folgenden Vorverarbeitungsschritte notwendig sind:
Diese Übung ist Teil des Kurses
<Kurs>Clusteranalyse in R</Kurs>Interaktive praktische Übung
Verwandle Theorie mit einer unserer interaktiven Übungen in die Praxis
Übung starten