En küçük kümeleri değerlendirme
Bu egzersizde DBSCAN'den çıkan kümelere bakacak ve bazı kümeleri sahtekârlık olarak işaretleyeceksin:
- önce kümelerin ne kadar büyük olduğunu bulacak ve en küçükleri filtreleyeceksin
- sonra en küçük olanları alıp bunları sahtekârlık olarak işaretleyeceksin
- son olarak, orijinal etiketlerle karşılaştırıp bunun gerçekten sahtekârlığı tespit etmede iyi bir iş çıkarıp çıkarmadığını kontrol edeceksin.
DBSCAN model tahminleri mevcut, dolayısıyla n_clusters ve küme etiketleri (pred_labels altında kayıtlı) elinde. Hadi deneyelim!
Bu egzersiz, kursun bir parçasıdır
Python ile Sahtekarlık Tespiti
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Count observations in each cluster number
counts = np.bincount(____[____ >= 0])
# Print the result
print(counts)