RandomizedSearchCV in Scikit Learn

Esercitiamoci a costruire un oggetto RandomizedSearchCV usando Scikit Learn.

La griglia degli iperparametri deve includere max_depth (tutti i valori tra 5 e 25, inclusi) e max_features ('auto' e 'sqrt').

Le opzioni desiderate per l'oggetto RandomizedSearchCV sono:

Un Estimator RandomForestClassifier con n_estimators pari a 80.
Cross validation a 3 fold (cv)
Usa roc_auc per valutare i modelli
Usa 4 core per l'elaborazione in parallelo (n_jobs)
Assicurati di effettuare il refit del modello migliore e di restituire gli score di training
Esegui il campionamento di soli 5 modelli per efficienza (n_iter)

Gli insiemi di dati X_train e y_train sono già caricati per te.

Ricorda: per estrarre gli iperparametri scelti, li trovi in cv_results_, con una colonna per ogni iperparametro. Per esempio, la colonna per l'iperparametro criterion è param_criterion.

Questo esercizio fa parte del corso

Ottimizzazione degli iperparametri in Python

Visualizza corso

Istruzioni dell'esercizio

Crea una griglia di iperparametri come specificato sopra.
Crea un oggetto RandomizedSearchCV come descritto sopra.
Esegui il fit dell'oggetto RandomizedSearchCV sui dati di training.
Fai l'indicizzazione in cv_results_ per stampare i valori scelti dal processo di modellazione per entrambi gli iperparametri (max_depth e max_features).

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

# Create the parameter grid
param_grid = {'max_depth': list(range(____,26)), 'max_features': [____ , ____]} 

# Create a random search object
random_rf_class = RandomizedSearchCV(
    estimator = ____(n_estimators=____),
    param_distributions = ____, n_iter = ____,
    scoring=____, n_jobs=____, cv = ____, refit=____, return_train_score = ____ )

# Fit to the training data
____.fit(X_train, y_train)

# Print the values used for both hyperparameters
print(random_rf_class.cv_results_[____])
print(random_rf_class.cv_results_[____])

Modifica ed esegui il codice

Questo esercizio fa parte del corso

Ottimizzazione degli iperparametri in Python

IntermediárioNível de habilidade

4.9+

Inizia il corso gratuitamente

In questo capitolo introduttivo imparerai la differenza tra iperparametri e parametri. Farai pratica nell’estrazione e analisi dei parametri e nell’impostare i valori degli iperparametri per diversi algoritmi di Machine Learning popolari. Lungo il percorso scoprirai consigli pratici e trucchi su quali iperparametri ottimizzare, quali valori provare e come costruire learning curve per analizzare le tue scelte.

Exercise 1: Introduzione e "Parametri"Exercise 2: Parametri nella Regressione Logistica Exercise 3: Estrazione di un parametro della Logistic Regression Exercise 4: Estrarre un parametro di Random Forest Exercise 5: Introduzione agli iperparametri Exercise 6: Iperparametri nei Random Forest Exercise 7: Esplorare gli iperparametri di Random Forest Exercise 8: Iperparametri di KNN Exercise 9: Impostare e analizzare i valori degli iperparametri Exercise 10: Automatizzare la scelta degli iperparametri Exercise 11: Costruire le learning curve

Questo capitolo ti presenta una metodologia molto usata per l’ottimizzazione automatica degli iperparametri chiamata Grid Search. Imparerai cos’è, come funziona e farai pratica a eseguire una Grid Search con Scikit Learn. Vedrai poi come analizzare l’output di una Grid Search e farai esperienza pratica nel farlo.

Exercise 1: Introduzione a Grid Search Exercise 2: Crea funzioni per la Grid Search Exercise 3: Ottimizza iterativamente più iperparametri Exercise 4: Quanti modelli?Exercise 5: Grid Search con Scikit Learn Exercise 6: Input di GridSearchCV Exercise 7: GridSearchCV con Scikit Learn Exercise 8: Capire l'output di una grid search Exercise 9: Usare i migliori risultati Exercise 10: Esplorare i risultati della grid search Exercise 11: Analizzare i risultati migliori Exercise 12: Usare i risultati migliori

In questo capitolo ti verrà presentata un’altra metodologia molto diffusa per l’ottimizzazione automatica degli iperparametri chiamata Random Search. Imparerai cos’è, come funziona e, soprattutto, in cosa differisce dalla grid search. Vedrai vantaggi e svantaggi di questo metodo e quando preferirlo rispetto alla Grid Search. Farai pratica a eseguire una Random Search con Scikit Learn e a visualizzare e interpretare l’output.

Exercise 1: Introduzione al Random Search Exercise 2: Campiona casualmente gli iperparametri Exercise 3: Ricerca casuale con Random Forest Exercise 4: Visualizzare una Random Search Exercise 5: Random Search in Scikit Learn Exercise 6: Input di RandomSearchCV Exercise 7: L'oggetto RandomizedSearchCV Exercise 8: RandomizedSearchCV in Scikit Learn

Esercizio attuale

Exercise 9: Confrontare Grid Search e Random Search Exercise 10: Confronto tra Random Search e Grid Search Exercise 11: Grid e Random Search a confronto

In questo capitolo finale assaggerai metodologie più avanzate di ottimizzazione degli iperparametri note come "informed search". Questo include un approccio detto Coarse To Fine e algoritmi di ottimizzazione Bayesiani e Genetici. Imparerai come l’informed search differisce dalla uninformed search e acquisirai abilità pratiche con ciascuna metodologia citata, confrontandole lungo il percorso.

Exercise 1: Ricerca informata: dal grossolano al fine Exercise 2: Visualizzare Coarse to Fine Exercise 3: Iterazioni Coarse to Fine Exercise 4: Ricerca informata: statistica bayesiana Exercise 5: La regola di Bayes in Python Exercise 6: Tuning bayesiano degli iperparametri con Hyperopt Exercise 7: Informed Search: Algoritmi genetici Exercise 8: Ottimizzazione genetica degli iperparametri con TPOT Exercise 9: Analizzare la stabilità di TPOT Exercise 10: Congratulazioni!