开始使用免费开始使用

步骤 2:识别文本来源

在这个小练习中,您将加载并查看一小份来自波士顿周边的房源租赁评论语料库。希望您已经熟悉 read.csv(),它可以加载逗号分隔文件。看起来很基础,但本章的重点是带您从头到尾完成整个工作流,所以先从数据读取开始吧!

接下来,使用 str() 查看数据框的结"构"。该函数可以紧凑地显示向量的初始值和类别类型,十分方便。

最后,使用 dim() 打印数据框的维"度"。对于数据框,控制台会打印行数和列数。

在数据探索中,常见的还有 head()tail()summary() 等函数。但在这里我们尽量简短地检查数据,以便更快进入有趣的情感分析!

本练习是课程的一部分

R 中的情感分析

查看课程

练习说明

波士顿房源租赁评论存储在由预定义变量 bos_reviews_file 指向的 CSV 文件中。

  • 使用 read.csv()bos_reviews_file 加载房源评论。将对象命名为 bos_reviews
  • 使用基础函数 str() 作用于 bos_reviews,检查数据框的结构。
  • 调用 dim() 作用于 bos_reviews,查看您将要处理的评论有多少条。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# bos_reviews_file has been pre-defined
bos_reviews_file

# load raw text
bos_reviews <- ___

# Structure
___

# Dimensions
___
编辑并运行代码