言語の検出
市議会は、Get It Done アプリのスペイン語版を作る価値があるか検討しています。スペイン語話者の有権者は多いものの、実際に使ってもらえるか確信がありません。多言語対応にするとシステムが複雑になるため、正当化が必要です。
そこで、Sam にスペイン語でリクエストを投稿している人がどれくらいいるかを調べるよう依頼しました。
彼女はすでに CSV を dumping_df という変数に読み込み、次の列に絞り込んでいます。

Get It Done アプリのスペイン語版に対する需要を数値化できるよう、Sam を手伝ってください。スペイン語を使っている依頼者が何人いるかを算出し、最終結果を出力しましょう。
この演習はコースの一部です
Python で始める AWS Boto 入門
演習の手順
- DataFrame の各行について、優勢な言語を検出します。
- 選択された最初の言語を
'lang'列に代入します。 - スペイン語の投稿件数を合計します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# For each dataframe row
for index, row in dumping_df.iterrows():
# Get the public description field
description =dumping_df.loc[index, 'public_description']
if description != '':
# Detect language in the field content
resp = comprehend.____(____=description)
# Assign the top choice language to the lang column.
dumping_df.loc[index, 'lang'] = resp['____'][0]['____']
# Count the total number of spanish posts
spanish_post_ct = len(dumping_df[dumping_df.lang == 'es'])
# Print the result
print("{} posts in Spanish".format(spanish_post_ct))