Ajuster un modèle linéaire
Nous allons maintenant ajuster un modèle linéaire, parce qu'il est simple et facile à comprendre. Une fois le modèle ajusté, nous pourrons voir quelles variables prédictives semblent être linéairement corrélées de façon significative avec la cible, ainsi que l'ampleur de leur effet sur celle‑ci. Notre jugement sur la significativité des prédicteurs se fonde sur les valeurs p des coefficients. On utilise ici un test t pour vérifier statistiquement si le coefficient diffère de façon significative de 0. La valeur p représente la probabilité que le coefficient d'une caractéristique ne diffère pas de zéro. En général, on considère qu'une valeur p inférieure à 0,05 signifie que le coefficient est significativement différent de 0.
Cette activité fait partie du cours
Machine Learning pour la finance en Python
Instructions de l’exercice
- Ajustez le modèle linéaire (avec la méthode
.fit()) et enregistrez les résultats dans la variableresults. - Affichez le sommaire des résultats avec la fonction
.summary(). - Affichez les valeurs p des résultats (la propriété
.pvaluesderesults). - Générez des prédictions à partir de
train_featuresettest_featuresavec la fonction.predict()de notre objetresults.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Create the linear model and complete the least squares fit
model = sm.OLS(train_targets, train_features)
results = model.____ # fit the model
print(results.____)
# examine pvalues
# Features with p <= 0.05 are typically considered significantly different from 0
print(results.____)
# Make predictions from our model for train and test sets
train_predictions = results.predict(train_features)
test_predictions = ____