Навчання Naive Bayes із вибором ознак
Тепер ви повторно запустите модель класифікації тексту Naive Bayes, яку ви запускали наприкінці Розділу 3, використовуючи вибір із попередньої вправи: стовпці title і category_desc з набору даних volunteer.
Ця вправа є частиною курсу
Передобробка для машинного навчання в Python
Інструкції до вправи
- Застосуйте
train_test_split()до текстового вектораfiltered_text, мітокy(це міткиcategory_desc) і передайте множинуyпараметруstratify, адже розподіл класів нерівномірний. - Навчіть модель Naive Bayes
nbнаX_trainіy_train. - Обчисліть точність моделі
nbна тестовій вибірці.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)
# Fit the model to the training data
nb.____
# Print out the model's accuracy
print(nb.____)