列の集計
在庫データを整理・分析して、高価格商品の在庫パターンを把握しましょう。生の在庫データには不要なアイテムが含まれることが多く、カテゴリーごとに整理する必要があります。高額商品(5ドル超)に絞り込んでデータをクリーニングし、正確な合計値を算出したうえで、カテゴリー別に整理します。このように整理・集計されたデータは、どの部門がプレミアム商品に最も多くの投資をしているかを把握するのに役立ちます。
tablesaw パッケージはあらかじめインポートされています。
この演習はコースの一部です
Java によるデータクリーニング
演習の手順
- 高額商品(
Unit_Priceが $5.00 超)を抽出します。 - カテゴリーごとに
Stock_Quantityの合計を計算します。 Categoryで結果をグループ化します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
public class GroceryDataAggregation {
public static void main(String[] args) {
Table inventory = Table.read().csv("grocery_inventory.csv");
Table quantityByCategory = inventory
// Find expensive items (price > $5.00)
.where(inventory.doubleColumn("Unit_Price").____(5.0))
// Calculate total stock for each category
.____("Stock_Quantity", ____)
// Group results by product category
.____("Category");
System.out.println("Total quantity by category:");
System.out.println(quantityByCategory.first(5));
}
}