STATA-data importeren met foreign (2)
Data kan erg verschillend zijn: van karaktervectoren tot categorische variabelen, datums en meer. In zulke gevallen komen de extra argumenten van read.dta() goed van pas.
De argumenten die je het vaakst zult gebruiken zijn convert.dates, convert.factors, missing.type en convert.underscore. Hun betekenis is vrij duidelijk, zoals Filip in de video uitlegde. Het draait erom STATA-data correct om te zetten naar standaard R-datastructuren. Typ ?read.dta om de standaardwaarden te bekijken.
De gegevensset voor deze oefening bevat sociaal-economische maten en toegang tot onderwijs voor verschillende personen (Bron: World Bank). Deze data is beschikbaar als edequality.dta, die zich in de map worldbank in je werkdirectory bevindt.
Deze oefening maakt deel uit van de cursus
Gevorderd data importeren in R
Oefeninstructies
- Geef het pad naar het bestand op met
file.path(). Noem hetpath. Denk eraan dat het bestand"edequality.dta"in de map"worldbank"staat. - Gebruik de variabele
pathom het databestand op drie verschillende manieren te importeren; laat telkens de structuur zien metstr(): edu_equal_1: Door alleen het bestandspadpathdoor te geven aanread.dta().edu_equal_2: Door het bestandspadpathdoor te geven enconvert.factorsopFALSEte zetten.edu_equal_3: Door het bestandspadpathdoor te geven enconvert.underscoreopTRUEte zetten.
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# foreign is already loaded
# Specify the file path using file.path(): path
# Create and print structure of edu_equal_1
# Create and print structure of edu_equal_2
# Create and print structure of edu_equal_3