Prozkoumání datové sady dopravních značek
Abys lépe porozuměl/a tomu, jak funkce knn() dokázala rozpoznat značku stop, může být užitečné prozkoumat trénovací datovou sadu, kterou k tomu použila.
Každá dříve zaznamenaná dopravní značka byla rozdělena do mřížky 4x4 a pro každý ze 16 středových pixelů byla zaznamenána úroveň červené, zelené a modré barvy, jak je znázorněno níže.

Výsledkem je datová sada, která u každé značky zachycuje sign_type a také 16 × 3 = 48 barevných vlastností.
Toto cvičení je součástí kurzu
Supervised Learning v R: Klasifikace
Pokyny k cvičení
- Pomocí funkce
str()prozkoumej datovou sadusigns. - Pomocí funkce
table()spočítej počet pozorování pro každý typ značky – předej jí sloupec obsahující štítky. - Spusť připravený příkaz
aggregate()a zjisti, zda se průměrná úroveň červené barvy liší podle typu značky.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Examine the structure of the signs dataset
# Count the number of signs of each type
table(___)
# Check r10's average red level by sign type
aggregate(r10 ~ sign_type, data = signs, mean)