Kom igångKom igång gratis

Utforska datamängden med trafikskyltar

För att bättre förstå hur funktionen knn() kunde klassificera stoppskyltarna kan det vara bra att titta närmare på träningsdatan som användes.

Varje tidigare observerad gatuskylt delades in i ett 4x4-rutnät, och röd-, grön- och blånivån för vart och ett av de 16 centrala pixlarna registrerades enligt illustrationen här.

Stop Sign Data Encoding

Resultatet är en datamängd som registrerar sign_type samt 16 x 3 = 48 färgegenskaper för varje skylt.

Den här övningen är en del av kursen

Övervakat lärande i R: Klassificering

Visa kurs

Övningsinstruktioner

  • Använd funktionen str() för att undersöka datamängden signs.
  • Använd table() för att räkna antalet observationer av varje skylttyp genom att skicka kolumnen med etiketterna till funktionen.
  • Kör det angivna kommandot aggregate() för att se om den genomsnittliga rödnivån varierar beroende på skylttyp.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Examine the structure of the signs dataset


# Count the number of signs of each type
table(___)

# Check r10's average red level by sign type
aggregate(r10 ~ sign_type, data = signs, mean)
Redigera och kör kod