Imbriquer par sujet et par pays
Dans le dernier chapitre, vous avez construit un modèle linéaire pour chaque pays en imbriquant les données par pays, en ajustant un modèle à chaque ensemble de données, puis en « nettoyant » chaque modèle avec broom et en désimbriquant les coefficients. Le code ressemblait à ceci :
country_coefficients <- by_year_country %>%
nest(-country) %>%
mutate(model = map(data, ~ lm(percent_yes ~ year, data = .)),
tidied = map(model, tidy)) %>%
unnest(tidied)
Maintenant, vous allez de nouveau modéliser l'évolution du « pourcentage » de votes oui dans le temps, mais au lieu d'ajuster un modèle par pays, vous en ajusterez un pour chaque combinaison de pays et de sujet.
Cette activité fait partie du cours
Étude de cas : analyse exploratoire des données en R
Instructions de l’exercice
- Chargez les packages
purrr,tidyretbroom. - Affichez l'ensemble de données
by_country_year_topicdans la console. - Ajustez un modèle linéaire pour chaque pays et chaque sujet dans cet ensemble de données, et enregistrez le résultat sous le nom
country_topic_coefficients. Vous pouvez utiliser le code fourni comme point de départ. - Affichez l'ensemble de données
country_topic_coefficientsdans la console.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Load purrr, tidyr, and broom
# Print by_country_year_topic
# Fit model on the by_country_year_topic dataset
# Print country_topic_coefficients