始める無料で始める

株価のグループ別ブートストラップ

あなたは証券会社の統計アナリストとして働いています。New York Stock Exchange のサイトから、1か月分の株価(終値)データを受け取りました。データは次の形式です。

    Company   Price
1    Google 2863.00
2 Microsoft  335.46
3   Netflix  591.61
4  Facebook  346.91
...

上司は、各社ごとの分布を Microsoft Excel で簡単に可視化できるよう、会社ごとに列を分けて表示したいと考えています。

ワークスペースにはすでに df_stocks が読み込まれています。ブートストラップを行う関数 mean_dist() も用意済みです。mean_dist() は1社分のデータフレームを受け取り、ベクトルを出力します。この計算を並列で実行する必要があります。furrr パッケージは読み込まれています。

この演習はコースの一部です

R による並列プログラミング

コースを見る

演習の手順

  • ワーカーを4つ使う multisession を計画します。
  • Company のユニーク値でデータフレームを分割します。
  • 分割したデータフレームに mean_dist() を適用し、結果をデータフレームの列として結合する future_map() のバリアントを使います。
  • 計画を逐次実行(sequential)に戻します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Plan a multisession of four workers
___(___, ___)

df_stocks %>% 
# Split the data by Company
  ___(___) %>% 
# Apply mean_dist() using the correct future_map() variant
  ___(___)

# Revert to sequential plan
___(___)
コードを編集して実行