НачатьНачать бесплатно

When / Otherwise

Это задание похоже на предыдущее, но теперь нужно добавлять разные значения в зависимости от должности голосующего. Измените DataFrame voter_df: добавьте случайное число для членов совета с должностью Councilmember, значение 2 — для Mayor, а для всех остальных должностей — значение 0.

DataFrame voter_df уже определён и доступен для работы. Библиотека pyspark.sql.functions подключена под именем F.. Для генерации случайного значения используйте F.rand().

Это упражнение является частью курса

Очистка данных с помощью PySpark

Посмотреть курс

Инструкции к упражнению

  • Добавьте в voter_df столбец random_val, который содержит результат метода F.rand() для каждого голосующего с должностью Councilmember. Установите значение random_val равным 2 для Mayor. Для всех остальных должностей задайте значение 0.
  • Выведите несколько строк DataFrame и проверьте, корректно ли сработали условия.
  • Используйте условие .filter, чтобы найти строки со значением 0 в столбце random_val.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Add a column to voter_df for a voter based on their position
voter_df = voter_df.____('random_val',
                               when(voter_df.TITLE == 'Councilmember', ____)
                               .____(____, 2)
                               ____

# Show some of the DataFrame rows
voter_df.show()

# Use the .filter() clause with random_val
voter_df.____(____).show()
Редактировать и запускать код