Identifiera språk
Stadsfullmäktige undrar om det är värt att bygga en spansk version av applikationen Get It Done. Det finns en stor spansktalande befolkningsgrupp, men de är osäkra på om den kommer att använda tjänsten. Flerspråkig översättning komplicerar systemet och behöver motiveras.
De ber Sam ta reda på hur många personer som skickar in sina ärenden på spanska.
Hon har redan läst in CSV-filen i variabeln dumping_df och begränsat den till följande kolumner:

Hjälp Sam att mäta efterfrågan på en spansk version av Get It Done. Ta reda på hur många användare som skriver på spanska och skriv ut det slutliga resultatet!
Den här övningen är en del av kursen
Introduktion till AWS Boto i Python
Övningsinstruktioner
- Identifiera det dominerande språket för varje rad i DataFrame.
- Tilldela det första identifierade språket till kolumnen
'lang'. - Räkna det totala antalet inlägg på spanska.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# For each dataframe row
for index, row in dumping_df.iterrows():
# Get the public description field
description =dumping_df.loc[index, 'public_description']
if description != '':
# Detect language in the field content
resp = comprehend.____(____=description)
# Assign the top choice language to the lang column.
dumping_df.loc[index, 'lang'] = resp['____'][0]['____']
# Count the total number of spanish posts
spanish_post_ct = len(dumping_df[dumping_df.lang == 'es'])
# Print the result
print("{} posts in Spanish".format(spanish_post_ct))