Utforska datamängden med trafikskyltar
För att bättre förstå hur funktionen knn() kunde klassificera stoppskyltarna kan det vara bra att titta närmare på träningsdatan som användes.
Varje tidigare observerad gatuskylt delades in i ett 4x4-rutnät, och röd-, grön- och blånivån för vart och ett av de 16 centrala pixlarna registrerades enligt illustrationen här.

Resultatet är en datamängd som registrerar sign_type samt 16 x 3 = 48 färgegenskaper för varje skylt.
Den här övningen är en del av kursen
Övervakat lärande i R: Klassificering
Övningsinstruktioner
- Använd funktionen
str()för att undersöka datamängdensigns. - Använd
table()för att räkna antalet observationer av varje skylttyp genom att skicka kolumnen med etiketterna till funktionen. - Kör det angivna kommandot
aggregate()för att se om den genomsnittliga rödnivån varierar beroende på skylttyp.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Examine the structure of the signs dataset
# Count the number of signs of each type
table(___)
# Check r10's average red level by sign type
aggregate(r10 ~ sign_type, data = signs, mean)