Penggunaan sederhana .apply()
Mari berlatih menggunakan .apply()!
Anda diberikan himpunan data lengkap scores yang memuat performa siswa beserta informasi latar belakang mereka.
Tugas Anda adalah mendefinisikan fungsi prevalence() dan menerapkannya pada kolom groups_to_consider dari DataFrame scores. Fungsi ini harus mengambil grup/kategori yang paling dominan untuk suatu kolom (misalnya, jika kategori yang paling dominan di kolom lunch adalah standard, maka prevalence() harus mengembalikan standard).
Fungsi reduce() dari modul functools sudah diimpor.
Tip: pd.Series adalah objek Iterable. Oleh karena itu, Anda dapat menggunakan operasi standar pada objek tersebut.
Latihan ini merupakan bagian dari kursus
Berlatih Pertanyaan Wawancara Coding di Python
Instruksi latihan
- Buat sebuah list tuple berisi item unik dari objek
seriesyang diberikan dan jumlah kemunculannya. - Ekstrak tuple dengan jumlah kemunculan tertinggi menggunakan
reduce(). - Kembalikan item dengan jumlah kemunculan tertinggi.
- Terapkan fungsi prevalence pada DataFrame
scoresmenggunakan kolom yang ditentukan digroups_to_consider.
Latihan interaktif langsung praktik
Cobalah latihan ini dengan melengkapi kode contoh ini.
def prevalence(series):
vals = list(series)
# Create a tuple list with unique items and their counts
itms = [(____, ____) for x in set(____)]
# Extract a tuple with the highest counts using reduce()
res = reduce(lambda x, y: ____, ____)
# Return the item with the highest counts
return ____[____]
# Apply the prevalence function on the scores DataFrame
result = scores[groups_to_consider].____
print(result)