Lấy sai phân cho thất nghiệp
Bên cạnh việc thêm các độ trễ (lag) vào dữ liệu, bạn có thể thấy hữu ích khi tạo sai phân cho chuỗi.
Để tính sai phân, chỉ cần dùng lệnh diff(). Lệnh này yêu cầu bạn chỉ định đối tượng dữ liệu gốc, số độ trễ (lag), và bậc sai phân (differences).
Trong bài này, bạn sẽ mở rộng dữ liệu unemployment theo một hướng khác bằng cách thêm một vài thước đo sai phân hữu ích.
Bài tập này là một phần của khóa học
Nghiên cứu tình huống: Phân tích dữ liệu chuỗi thời gian của thành phố bằng R
Hướng dẫn bài tập
- Tạo sai phân theo tháng bậc một cho thất nghiệp của Mỹ bằng
diff(). Trong lời gọidiff(), hãy chỉ rõ cột bạn lấy từunemploymentcũng như các tham sốlagvàdifferences. Thay vì lưu vào một đối tượng mới để gộp, hãy lưu kết quả vào một cột mới trongunemploymenttên làus_monthlydiff. - Dùng một lời gọi tương tự với
diff()để tạo sai phân theo năm cho thất nghiệp của Mỹ. Lưu vàounemployment$us_yearlydiff. - Gọi
plot.xts()hai lần để vẽ biểu đồ cho thất nghiệp của Mỹ (unemployment$us) và mức thay đổi theo năm (unemployment$us_yearlydiff). Giữ nguyên tham sốtypetrong lần gọi thứ hai tớiplot.xts()để tạo biểu đồ cột. Lệnhpar()đã được viết sẵn sẽ giúp bạn xem cả hai biểu đồ cùng lúc.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Generate monthly difference in unemployment
unemployment$us_monthlydiff <- diff(___$___, lag = ___, differences = ___)
# Generate yearly difference in unemployment
unemployment$us_yearlydiff <-
# Plot US unemployment and annual difference
par(mfrow = c(2,1))
plot.xts(___)
plot.xts(___, type = "h")