SMOTE
SMOTE を使って不正クラスをオーバーサンプリングする場合、考慮する最近傍の数と、生成する合成の不正ケース数を決める必要があります。次の演習では、SMOTE の使い方を順を追って確認します。
データセット creditcard とライブラリ smotefamily、ggplot2 はすでにワークスペースに読み込まれています。dup_size パラメータは、既存の実データの不正ケースに対して SMOTE を何回ループさせるかを指定するものだと覚えておいてください。
この演習はコースの一部です
Rで学ぶ不正検知
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Set the number of fraud and legitimate cases, and the desired percentage of legitimate cases
n0 <- ___; n1 <- ___; r0 <- ___