When / Otherwise
Это задание похоже на предыдущее, но теперь нужно добавлять разные значения в зависимости от должности голосующего. Измените DataFrame voter_df: добавьте случайное число для членов совета с должностью Councilmember, значение 2 — для Mayor, а для всех остальных должностей — значение 0.
DataFrame voter_df уже определён и доступен для работы. Библиотека pyspark.sql.functions подключена под именем F.. Для генерации случайного значения используйте F.rand().
Это упражнение является частью курса
Очистка данных с помощью PySpark
Инструкции к упражнению
- Добавьте в
voter_dfстолбецrandom_val, который содержит результат методаF.rand()для каждого голосующего с должностью Councilmember. Установите значениеrandom_valравным 2 для Mayor. Для всех остальных должностей задайте значение 0. - Выведите несколько строк DataFrame и проверьте, корректно ли сработали условия.
- Используйте условие
.filter, чтобы найти строки со значением 0 в столбцеrandom_val.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Add a column to voter_df for a voter based on their position
voter_df = voter_df.____('random_val',
when(voter_df.TITLE == 'Councilmember', ____)
.____(____, 2)
____
# Show some of the DataFrame rows
voter_df.show()
# Use the .filter() clause with random_val
voter_df.____(____).show()