Genomsnittligt betyg per kurs
Ett bra sätt att rekommendera kurser är att lyfta fram de högst betygsatta, eftersom DataCamp-studenter ofta uppskattar kurser som har fått höga omdömen av sina kurskamrater.
I den här övningen ska du färdigställa transformeringsfunktionen transform_avg_rating(), som aggregerar betygsdata med hjälp av .groupby()-metoden i pandas DataFrame. Målet är att få en DataFrame med två kolumner – ett kurs-id och dess genomsnittliga betyg:
| course_id | avg_rating |
|---|---|
| 123 | 4.72 |
| 111 | 4.62 |
| … | … |
Du ska alltså färdigställa den här transformeringsfunktionen och sedan applicera den på råa betygsdata som hämtas via hjälpfunktionen extract_rating_data(), vilken hämtar kursbetyg från tabellen rating.
Den här övningen är en del av kursen
Introduktion till datatekniker
Övningsinstruktioner
- Färdigställ funktionen
transform_avg_rating()genom att gruppera på kolumnencourse_idoch beräkna medelvärdet av kolumnenrating. - Använd
extract_rating_data()för att hämta råa betygsdata. Funktionen tar databasmotorndb_enginessom argument. - Applicera
transform_avg_rating()på de betygsdata du hämtat.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Complete the transformation function
def transform_avg_rating(rating_data):
# Group by course_id and extract average rating per course
avg_rating = rating_data.____('____').rating.____()
# Return sorted average ratings per course
sort_rating = avg_rating.sort_values(ascending=False).reset_index()
return sort_rating
# Extract the rating data into a DataFrame
rating_data = extract_rating_data(____)
# Use transform_avg_rating on the extracted data and print results
avg_rating_data = transform_avg_rating(____)
print(avg_rating_data)