Wykrywanie języka
Rada Miejska zastanawia się, czy warto zbudować hiszpańskojęzyczną wersję aplikacji Get It Done. W mieście mieszka duża społeczność mówiąca po hiszpańsku, ale nie wiadomo, czy będzie aktywnie korzystać z aplikacji. Dodanie obsługi wielu języków znacznie komplikuje system – i wymaga solidnego uzasadnienia.
Rada prosi Sam o sprawdzenie, ile osób przesyła zgłoszenia po hiszpańsku.
Sam wczytała już plik CSV do zmiennej dumping_df i zawęziła go do następujących kolumn:

Pomóż Sam oszacować zapotrzebowanie na hiszpańską wersję aplikacji Get It Done. Sprawdź, ile osób pisze zgłoszenia po hiszpańsku, i wyświetl końcowy wynik!
To ćwiczenie jest częścią kursu
Wprowadzenie do AWS Boto w Pythonie
Instrukcje do ćwiczenia
- Dla każdego wiersza w DataFrame wykryj dominujący język.
- Przypisz pierwszy wykryty język do kolumny
'lang'. - Policz łączną liczbę zgłoszeń napisanych po hiszpańsku.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# For each dataframe row
for index, row in dumping_df.iterrows():
# Get the public description field
description =dumping_df.loc[index, 'public_description']
if description != '':
# Detect language in the field content
resp = comprehend.____(____=description)
# Assign the top choice language to the lang column.
dumping_df.loc[index, 'lang'] = resp['____'][0]['____']
# Count the total number of spanish posts
spanish_post_ct = len(dumping_df[dumping_df.lang == 'es'])
# Print the result
print("{} posts in Spanish".format(spanish_post_ct))