De grid-searchresultaten verkennen

Je gaat nu de eigenschap cv_results_ verkennen van het GridSearchCV-object dat in de video is gedefinieerd. Dit is een dictionary die we kunnen inlezen in een pandas DataFrame en die veel nuttige informatie bevat over de grid search die we zojuist hebben uitgevoerd.

Een geheugensteun voor de verschillende kolomtypes in deze eigenschap:

time_-kolommen
param_-kolommen (één per hyperparameter) en de enkele params-kolom (met alle hyperparameteraanstellingen)
een train_score-kolom voor elke cv-fold, inclusief de kolommen mean_train_score en std_train_score
een test_score-kolom voor elke cv-fold, inclusief de kolommen mean_test_score en std_test_score
een rank_test_score-kolom met een getal van 1 tot n (aantal iteraties) dat de rijen rangschikt op basis van hun mean_test_score

Deze oefening maakt deel uit van de cursus

Hyperparameter Tuning in Python

Oefeninstructies

Lees de eigenschap cv_results_ van het grid_rf_class GridSearchCV-object in een DataFrame en print alles om te inspecteren.
Haal de enkele kolom op met het woordenboek van alle hyperparameters die in elke iteratie van de grid search zijn gebruikt, en print deze.
Haal de rij op met de beste gemiddelde testscore door te indexeren met de kolom rank_test_score, en print deze.

Interactieve oefening met praktijkervaring

Probeer deze oefening door deze voorbeeldcode aan te vullen.

# Read the cv_results property into a dataframe & print it out
cv_results_df = pd.DataFrame(grid_rf_class.____)
print(____)

# Extract and print the column with a dictionary of hyperparameters used
column = cv_results_df.loc[:, [____]]
print(____)

# Extract and print the row that had the best mean test score
best_row = cv_results_df[cv_results_df[____] == ____ ]
print(best_row)

Code bewerken en uitvoeren

Deze oefening maakt deel uit van de cursus

Hyperparameter Tuning in Python

SkillTag.level.intermediateSkillTag.label

4.9+

Begin gratis met de cursus

In dit introductiehoofdstuk leer je het verschil tussen hyperparameters en parameters. Je oefent met het extraheren en analyseren van parameters en het instellen van hyperparameterwaarden voor enkele populaire machine learning-algoritmen. Onderweg leer je best practices en handige tips om te bepalen welke hyperparameters je afstelt, welke waarden je kiest, en bouw je leercurves om je hyperparameterkeuzes te analyseren.

Exercise 1: Introductie & 'Parameters'Exercise 2: Parameters in Logistic Regression Exercise 3: Een parameter van Logistic Regression extraheren Exercise 4: Een parameter uit een Random Forest extraheren Exercise 5: Kennismaken met hyperparameters Exercise 6: Hyperparameters in Random Forests Exercise 7: Random Forest-hyperparameters verkennen Exercise 8: Hyperparameters van KNN Exercise 9: Hyperparameterwaarden instellen en analyseren Exercise 10: Hyperparameterkeuze automatiseren Exercise 11: Leercurves bouwen

Dit hoofdstuk introduceert een populaire methode voor geautomatiseerde hyperparameter tuning: Grid Search. Je leert wat het is, hoe het werkt en oefent met een Grid Search in Scikit Learn. Daarna leer je hoe je de output van een Grid Search analyseert en doe je hier praktische ervaring mee op.

Exercise 1: Introductie van Grid Search Exercise 2: Bouw Grid Search-functies Exercise 3: Iteratief meerdere hyperparameters afstemmen Exercise 4: Hoeveel modellen?Exercise 5: Grid search met Scikit Learn Exercise 6: GridSearchCV-invoer Exercise 7: GridSearchCV met Scikit Learn Exercise 8: De uitkomst van een grid search begrijpen Exercise 9: De beste resultaten gebruiken Exercise 10: De grid-searchresultaten verkennen

Huidige oefening

Exercise 11: De beste resultaten analyseren Exercise 12: De beste resultaten gebruiken

In dit hoofdstuk maak je kennis met een andere populaire methode voor geautomatiseerde hyperparameter tuning: Random Search. Je leert wat het is, hoe het werkt en vooral hoe het verschilt van grid search. Je leert de voor- en nadelen van deze methode en wanneer je deze kiest ten opzichte van Grid Search. Je oefent met een Random Search in Scikit Learn en met het visualiseren en interpreteren van de output.

Exercise 1: Introductie van Random Search Exercise 2: Hyperparameters willekeurig bemonsteren Exercise 3: Willekeurig zoeken met Random Forest Exercise 4: Een Random Search visualiseren Exercise 5: Random Search in Scikit Learn Exercise 6: RandomSearchCV-invoer Exercise 7: Het RandomizedSearchCV-object Exercise 8: RandomSearchCV in Scikit Learn Exercise 9: Grid Search en Random Search vergelijken Exercise 10: Random Search en Grid Search vergelijken Exercise 11: Grid en Random Search naast elkaar

In dit laatste hoofdstuk maak je kennis met meer geavanceerde hyperparameter tuning-methoden, bekend als 'informed search'. Dit omvat een aanpak genaamd Coarse To Fine en Bayesian en Genetic hyperparameter tuning-algoritmen. Je leert hoe informed search verschilt van uninformed search en ontwikkelt praktische vaardigheden met elk van de genoemde methoden, terwijl je ze vergelijkt en tegenover elkaar zet.

Exercise 1: Informed Search: van grof naar fijn Exercise 2: Coarse to Fine visualiseren Exercise 3: Coarse-to-fine-iteraties Exercise 4: Informed Search: Bayesiaanse statistiek Exercise 5: De regel van Bayes in Python Exercise 6: Bayesiaanse hyperparametertuning met Hyperopt Exercise 7: Informed Search: genetische algoritmen Exercise 8: Genetische hyperparameter-tuning met TPOT Exercise 9: De stabiliteit van TPOT analyseren Exercise 10: Gefeliciteerd!