HTTP?用 httr!(1)
从互联网下载文件意味着发送一个 GET 请求并接收您所请求的文件。内部而言,之前讨论的所有函数都使用 GET 请求来下载文件。
httr 提供了一个便捷函数 GET() 来执行该 GET 请求。其结果是一个 response 对象,便于访问状态码、content-type,以及最重要的实际内容。
您可以使用 content() 函数从请求中提取内容。撰写本文时,有三种方式获取该内容:作为原始对象(raw)、作为字符向量,或作为 R 对象(例如列表)。如果您没有通过 as 参数告知 content() 以何种方式获取内容,它会根据 content-type 尽力判断最合适的类型。
本练习是课程的一部分
R 数据导入进阶
练习说明
- 加载
httr包。它已安装在 DataCamp 的服务器上。 - 使用
GET()获取存储在url中的 URL。将此GET()调用的结果保存为resp。 - 打印
resp对象。它包含哪些信息? - 使用
content()获取resp的内容,并将as参数设为"raw"。将得到的向量赋给raw_content。 - 使用
head()打印raw_content的前几个值。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Load the httr package
# Get the url, save response to resp
url <- "http://www.example.com/"
# Print resp
# Get the raw content of resp: raw_content
# Print the head of raw_content