Ange datatyper för kolumner
När du läser in data från en text- eller CSV-fil bör du ange namn och datatyper för varje kolumn. Funktionen read() försöker avgöra om den första raden i datamängden innehåller kolumnnamn. R är bra på att identifiera vissa datatyper, men om du läser in en kategorisk variabel kodad som 0, 1 och 2 tolkas den som en numerisk variabel – och du behöver då ange rätt datatyp för den kolumnen efter inläsningen.
Den här övningen är en del av kursen
Multivariata sannolikhetsfördelningar i R
Övningsinstruktioner
- Tilldela de nya kolumnnamnen till datamängden
wineoch kontrollera sedan att de har tilldelats korrekt. - Ändra kolumnen
Typetill en faktor med tre nivåer. - Använd funktionen
str()för att kontrollera datatypen/strukturen före och efter att du ändrat datatypen.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Assign new names
___ <- c('Type', 'Alcohol', 'Malic', 'Ash', 'Alcalinity', 'Magnesium', 'Phenols', 'Flavanoids', 'Nonflavanoids','Proanthocyanins', 'Color', 'Hue', 'Dilution', 'Proline')
# Check the new column names
___
# Check data type/structure of each variable
str(___)
# Change the Type variable data type
___
# Check data type/structure again
___