Evaluar los clusters más pequeños
En este ejercicio vas a revisar los clusters que generó DBSCAN y marcar ciertos clusters como fraude:
- primero, necesitas averiguar el tamaño de los clusters y filtrar los más pequeños
- después, vas a tomar los más pequeños y marcarlos como fraude
- por último, compararás con las etiquetas originales para comprobar si realmente detecta bien el fraude.
Tienes disponibles las predicciones del modelo DBSCAN, así que n_clusters está disponible, así como las etiquetas de cluster, guardadas en pred_labels. ¡Vamos a probarlo!
Este ejercicio forma parte del curso
Fraud Detection in Python
ejercicio interactivo práctico
Prueba este ejercicio completando este código de ejemplo.
# Count observations in each cluster number
counts = np.bincount(____[____ >= 0])
# Print the result
print(counts)