ПочатиПочніть безкоштовно

Крок 2: Визначте джерела тексту

У цій короткій вправі ви завантажите й оглянете невеликий корпус відгуків про оренду житла в районі Бостона. Сподіваємося, ви вже знаєте read.csv(), яка дає змогу завантажити файл, розділений комами. Це може здаватися буденним, але мета цього розділу — провести вас через увесь робочий процес від початку до кінця, тож почнімо з отримання даних!

Далі просто застосуйте str(), щоб переглянути структуру датафрейму. Це зручна функція для компактного відображення початкових значень і типів класів для векторів.

Насамкінець застосуйте dim(), щоб вивести розмірність датафрейму. Для датафрейму у консолі буде надруковано кількість рядків і кількість стовпців.

Інші функції на кшталт head(), tail() або summary() часто використовують для дослідження даних, але тут ми обмежимося коротким оглядом, щоб ви швидше перейшли до цікавої частини — аналізу тональності!

Ця вправа є частиною курсу

Аналіз тональності в R

Переглянути курс

Інструкції до вправи

Відгуки про оренду житла в Бостоні збережені в CSV‑файлі, шлях до якого задано у попередньо визначеній змінній bos_reviews_file.

  • Завантажте відгуки з bos_reviews_file за допомогою read.csv(). Назвіть об'єкт bos_reviews.
  • Перегляньте структуру датафрейму, застосувавши базову функцію str() до bos_reviews.
  • Дізнайтеся, скількома відгуками ви оперуєте, викликавши dim() для bos_reviews.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# bos_reviews_file has been pre-defined
bos_reviews_file

# load raw text
bos_reviews <- ___

# Structure
___

# Dimensions
___
Редагувати та запускати код