Bắt đầu ngayBắt đầu miễn phí

Lấy sai phân cho thất nghiệp

Bên cạnh việc thêm các độ trễ (lag) vào dữ liệu, bạn có thể thấy hữu ích khi tạo sai phân cho chuỗi.

Để tính sai phân, chỉ cần dùng lệnh diff(). Lệnh này yêu cầu bạn chỉ định đối tượng dữ liệu gốc, số độ trễ (lag), và bậc sai phân (differences).

Trong bài này, bạn sẽ mở rộng dữ liệu unemployment theo một hướng khác bằng cách thêm một vài thước đo sai phân hữu ích.

Bài tập này là một phần của khóa học

Nghiên cứu tình huống: Phân tích dữ liệu chuỗi thời gian của thành phố bằng R

Xem khóa học

Hướng dẫn bài tập

  • Tạo sai phân theo tháng bậc một cho thất nghiệp của Mỹ bằng diff(). Trong lời gọi diff(), hãy chỉ rõ cột bạn lấy từ unemployment cũng như các tham số lagdifferences. Thay vì lưu vào một đối tượng mới để gộp, hãy lưu kết quả vào một cột mới trong unemployment tên là us_monthlydiff.
  • Dùng một lời gọi tương tự với diff() để tạo sai phân theo năm cho thất nghiệp của Mỹ. Lưu vào unemployment$us_yearlydiff.
  • Gọi plot.xts() hai lần để vẽ biểu đồ cho thất nghiệp của Mỹ (unemployment$us) và mức thay đổi theo năm (unemployment$us_yearlydiff). Giữ nguyên tham số type trong lần gọi thứ hai tới plot.xts() để tạo biểu đồ cột. Lệnh par() đã được viết sẵn sẽ giúp bạn xem cả hai biểu đồ cùng lúc.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Generate monthly difference in unemployment
unemployment$us_monthlydiff <- diff(___$___, lag = ___, differences = ___)

# Generate yearly difference in unemployment
unemployment$us_yearlydiff <- 

# Plot US unemployment and annual difference
par(mfrow = c(2,1))
plot.xts(___)
plot.xts(___, type = "h")
Chỉnh sửa và Chạy Mã