Sprache erkennen
Der Stadtrat überlegt, ob sich eine spanische Version der Get It Done‑App lohnt. Es gibt eine große spanischsprachige Wählerschaft, aber man ist unsicher, ob sie die App nutzen würden. Mehrsprachige Übersetzung macht das System komplexer und muss gut begründet sein.
Sam soll herausfinden, wie viele Leute Anfragen auf Spanisch posten.
Sie hat die CSV bereits in die Variable dumping_df geladen und auf die folgenden Spalten reduziert:

Hilf Sam, die Nachfrage nach einer spanischen Version der Get It Done‑App zu quantifizieren. Finde heraus, wie viele Anfragende Spanisch verwenden, und gib das Endergebnis aus!
Diese Übung ist Teil des Kurses
<Kurs>Einführung in AWS Boto mit Python</Kurs>Übungsanweisungen
- Erkenne für jede Zeile im DataFrame die dominante Sprache.
- Weise die zuerst erkannte Sprache der Spalte
'lang'zu. - Zähle die Gesamtzahl der Beiträge auf Spanisch.
Interaktive praktische Übung
Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.
# For each dataframe row
for index, row in dumping_df.iterrows():
# Get the public description field
description =dumping_df.loc[index, 'public_description']
if description != '':
# Detect language in the field content
resp = comprehend.____(____=description)
# Assign the top choice language to the lang column.
dumping_df.loc[index, 'lang'] = resp['____'][0]['____']
# Count the total number of spanish posts
spanish_post_ct = len(dumping_df[dumping_df.lang == 'es'])
# Print the result
print("{} posts in Spanish".format(spanish_post_ct))