Bắt đầu ngayBắt đầu miễn phí

Dùng thống kê để xác định hành vi bình thường

Trong các bài trước, bạn đã thấy gian lận phổ biến hơn ở một số loại giao dịch nhất định, nhưng không có cách rõ ràng để phân đoạn dữ liệu, chẳng hạn theo nhóm tuổi. Lần này, hãy khảo sát giá trị trung bình đã chi trong các giao dịch bình thường so với giao dịch gian lận. Điều này giúp bạn hình dung các giao dịch gian lận khác biệt về mặt cấu trúc so với các giao dịch bình thường như thế nào.

Bài tập này là một phần của khóa học

Phát hiện gian lận với Python

Xem khóa học

Hướng dẫn bài tập

  • Tạo hai dataframe mới từ các quan sát gian lận và không gian lận. Lấy dữ liệu trong df bằng .loc và đặt điều kiện "nơi fraud bằng 1" và "nơi fraud bằng 0" để tạo các dataframe mới.
  • Vẽ cột amount của các dataframe vừa tạo bằng hàm vẽ biểu đồ histogram và lần lượt gán nhãn fraudnonfraud cho các biểu đồ.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Create two dataframes with fraud and non-fraud data 
df_fraud = df.____[df.____ == ____] 
df_non_fraud = df.____[df.____ == ____]

# Plot histograms of the amounts in fraud and non-fraud data 
plt.hist(____.____, alpha=0.5, label='____')
plt.hist(____.____, alpha=0.5, label='____')
plt.legend()
plt.show()
Chỉnh sửa và Chạy Mã