質問ごとの平均回答数
前の演習で作成したテーブルは、tagged_answers としてあらかじめ読み込まれています。このテーブルを使って、各質問が平均していくつの回答を得ているかを調べましょう。
tagged_answers <- question_answer_counts %>%
inner_join(question_tags, by = c("id" = "question_id")) %>%
inner_join(tags, by = c("tag_id" = "id"))
このテーブルの重要な変数として、各質問の回答数を表す n、各質問に関連付けられたタグ名を表す tag_name があります。
それでは、おなじみの dplyr の動詞を使って、各質問が平均していくつの回答を得ているのかを求めてみましょう。
この演習はコースの一部です
dplyr で行うデータの結合
演習の手順
tagged_answersテーブルをtag_nameで集計します。tagged_answersを要約して、questions(件数)とaverage_answers(平均回答数)を求めます。- 得られた
questions列を降順で並べ替えます。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
tagged_answers %>%
# Aggregate by tag_name
___ %>%
# Summarize questions and average_answers
summarize(questions = ___,
average_answers = ___) %>%
# Sort the questions in descending order
___