Pasul 2: Identifică sursele de text
În acest exercițiu scurt vei încărca și examina un corpus mic de recenzii pentru proprietăți de închiriat din zona Boston. Probabil cunoști deja funcția read.csv(), care îți permite să încarci un fișier CSV. Poate părea un pas simplu, dar scopul acestui capitol este să parcurgi un flux de lucru complet de la început până la sfârșit – așa că hai să începem cu ingestia datelor!
În continuare, aplici str() pentru a examina structura data frame-ului. Este o funcție practică pentru afișarea compactă a valorilor inițiale și a tipurilor de clasă pentru vectori.
În final, aplici dim() pentru a afișa dimensiunile data frame-ului. În cazul unui data frame, consola va afișa numărul de rânduri și numărul de coloane.
Alte funcții precum head(), tail() sau summary() sunt adesea folosite pentru explorarea datelor, dar în acest caz păstrăm examinarea scurtă ca să ajungi mai repede la analiza de sentiment!
Acest exercițiu face parte din cursul
Analiza sentimentelor în R
Instrucțiuni pentru exercițiu
Recenziile pentru proprietățile de închiriat din Boston sunt stocate într-un fișier CSV, al cărui path este dat de variabila predefinită bos_reviews_file.
- Încarcă recenziile din
bos_reviews_filefolosindread.csv(). Numește obiectulbos_reviews. - Examinează structura data frame-ului cu funcția de bază
str()aplicată pebos_reviews. - Află câte recenzii ai la dispoziție apelând
dim()pebos_reviews.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# bos_reviews_file has been pre-defined
bos_reviews_file
# load raw text
bos_reviews <- ___
# Structure
___
# Dimensions
___