ÎncepețiÎncepe gratuit

Pasul 2: Identifică sursele de text

În acest exercițiu scurt vei încărca și examina un corpus mic de recenzii pentru proprietăți de închiriat din zona Boston. Probabil cunoști deja funcția read.csv(), care îți permite să încarci un fișier CSV. Poate părea un pas simplu, dar scopul acestui capitol este să parcurgi un flux de lucru complet de la început până la sfârșit – așa că hai să începem cu ingestia datelor!

În continuare, aplici str() pentru a examina structura data frame-ului. Este o funcție practică pentru afișarea compactă a valorilor inițiale și a tipurilor de clasă pentru vectori.

În final, aplici dim() pentru a afișa dimensiunile data frame-ului. În cazul unui data frame, consola va afișa numărul de rânduri și numărul de coloane.

Alte funcții precum head(), tail() sau summary() sunt adesea folosite pentru explorarea datelor, dar în acest caz păstrăm examinarea scurtă ca să ajungi mai repede la analiza de sentiment!

Acest exercițiu face parte din cursul

Analiza sentimentelor în R

Vezi cursul

Instrucțiuni pentru exercițiu

Recenziile pentru proprietățile de închiriat din Boston sunt stocate într-un fișier CSV, al cărui path este dat de variabila predefinită bos_reviews_file.

  • Încarcă recenziile din bos_reviews_file folosind read.csv(). Numește obiectul bos_reviews.
  • Examinează structura data frame-ului cu funcția de bază str() aplicată pe bos_reviews.
  • Află câte recenzii ai la dispoziție apelând dim() pe bos_reviews.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# bos_reviews_file has been pre-defined
bos_reviews_file

# load raw text
bos_reviews <- ___

# Structure
___

# Dimensions
___
Editează și rulează codul