EmpezarEmpieza gratis

¿Qué estamos prediciendo?

¿Cuál de estos campos (o columnas) es el valor que intentamos predecir?

  • TAXES
  • SALESCLOSEPRICE
  • DAYSONMARKET
  • LISTPRICE

Este ejercicio forma parte del curso

Ingeniería de características con PySpark

Ver curso

Instrucciones del ejercicio

  • De las columnas listadas arriba, identifica cuál usaremos como variable dependiente $Y$.
  • Con el conjunto de datos cargado df, filtra para quedarte solo con la variable dependiente usando select(). Guarda este dataframe en la variable Y_df.
  • Muestra estadísticas descriptivas de la variable dependiente con describe() sobre Y_df y llama a show() para visualizarlas.

ejercicio interactivo práctico

Prueba este ejercicio completando este código de ejemplo.

# Select our dependent variable
Y_df = df.____([____])

# Display summary statistics
Y_df.____().____()
Editar y ejecutar código