Изучение набора данных с дорожными знаками
Чтобы лучше понять, как функция knn() смогла распознать знак «Стоп», полезно изучить обучающую выборку, которую она использовала.
Каждый ранее наблюдавшийся дорожный знак был разбит на сетку 4×4, и для каждого из 16 центральных пикселей были записаны уровни красного, зелёного и синего цветов — как показано на иллюстрации ниже.

В результате получается набор данных, в котором для каждого знака зафиксированы sign_type и 16 × 3 = 48 цветовых характеристик.
Это упражнение является частью курса
Обучение с учителем в R: классификация
Инструкции к упражнению
- Используйте функцию
str(), чтобы изучить набор данныхsigns. - Используйте
table(), чтобы подсчитать количество наблюдений по каждому типу знака: передайте в функцию столбец с метками. - Запустите предоставленную команду
aggregate(), чтобы проверить, различается ли средний уровень красного цвета в зависимости от типа знака.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Examine the structure of the signs dataset
# Count the number of signs of each type
table(___)
# Check r10's average red level by sign type
aggregate(r10 ~ sign_type, data = signs, mean)