Datentypen für Spalten festlegen
Wenn du Daten aus einer Text- oder CSV-Datei einliest, solltest du die Namen und Datentypen für jede Spalte angeben. Die Funktion read() versucht zu erkennen, ob der erste Eintrag des Datensatzes die Spaltennamen enthält. R ist gut darin, manche Datentypen zu erkennen. Wenn du jedoch eine kategoriale Variable einliest, die als 0, 1 und 2 kodiert ist, wird sie als numerische Variable eingelesen. Dann musst du den Datentyp für diese Spalte nach dem Einlesen festlegen.
Diese Übung ist Teil des Kurses
<Kurs>Multivariate Wahrscheinlichkeitsverteilungen in R</Kurs>Übungsanweisungen
- Weise dem Datensatz
winedie neuen Spaltennamen zu und prüfe anschließend, ob sie korrekt übernommen wurden. - Wandle die Spalte
Typein einen Faktor mit drei Ausprägungen um. - Verwende die Funktion
str(), um den Datentyp bzw. die Struktur vor und nach der Umwandlung zu prüfen.
Interaktive praktische Übung
Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.
# Assign new names
___ <- c('Type', 'Alcohol', 'Malic', 'Ash', 'Alcalinity', 'Magnesium', 'Phenols', 'Flavanoids', 'Nonflavanoids','Proanthocyanins', 'Color', 'Hue', 'Dilution', 'Proline')
# Check the new column names
___
# Check data type/structure of each variable
str(___)
# Change the Type variable data type
___
# Check data type/structure again
___