EmpezarEmpieza gratis

Evaluar los clusters más pequeños

En este ejercicio vas a revisar los clusters que generó DBSCAN y marcar ciertos clusters como fraude:

  • primero, necesitas averiguar el tamaño de los clusters y filtrar los más pequeños
  • después, vas a tomar los más pequeños y marcarlos como fraude
  • por último, compararás con las etiquetas originales para comprobar si realmente detecta bien el fraude.

Tienes disponibles las predicciones del modelo DBSCAN, así que n_clusters está disponible, así como las etiquetas de cluster, guardadas en pred_labels. ¡Vamos a probarlo!

Este ejercicio forma parte del curso

Fraud Detection in Python

Ver curso

ejercicio interactivo práctico

Prueba este ejercicio completando este código de ejemplo.

# Count observations in each cluster number
counts = np.bincount(____[____ >= 0])

# Print the result
print(counts)
Editar y ejecutar código