Mulai sekarangMulai gratis

Penggunaan sederhana .apply()

Mari berlatih menggunakan .apply()!

Anda diberikan himpunan data lengkap scores yang memuat performa siswa beserta informasi latar belakang mereka.

Tugas Anda adalah mendefinisikan fungsi prevalence() dan menerapkannya pada kolom groups_to_consider dari DataFrame scores. Fungsi ini harus mengambil grup/kategori yang paling dominan untuk suatu kolom (misalnya, jika kategori yang paling dominan di kolom lunch adalah standard, maka prevalence() harus mengembalikan standard).

Fungsi reduce() dari modul functools sudah diimpor.

Tip: pd.Series adalah objek Iterable. Oleh karena itu, Anda dapat menggunakan operasi standar pada objek tersebut.

Latihan ini merupakan bagian dari kursus

Berlatih Pertanyaan Wawancara Coding di Python

Lihat Kursus

Instruksi latihan

  • Buat sebuah list tuple berisi item unik dari objek series yang diberikan dan jumlah kemunculannya.
  • Ekstrak tuple dengan jumlah kemunculan tertinggi menggunakan reduce().
  • Kembalikan item dengan jumlah kemunculan tertinggi.
  • Terapkan fungsi prevalence pada DataFrame scores menggunakan kolom yang ditentukan di groups_to_consider.

Latihan interaktif langsung praktik

Cobalah latihan ini dengan melengkapi kode contoh ini.

def prevalence(series):
    vals = list(series)
    # Create a tuple list with unique items and their counts
    itms = [(____, ____) for x in set(____)]
    # Extract a tuple with the highest counts using reduce()
    res = reduce(lambda x, y: ____, ____)
    # Return the item with the highest counts
    return ____[____]

# Apply the prevalence function on the scores DataFrame
result = scores[groups_to_consider].____
print(result)
Edit dan Jalankan Kode