開始使用免費開始

對數正規化

標準化很重要,能確保所有特徵可相互比較。對數正規化是常見的標準化方法。你將檢查部分特徵的變異數,並計算所有特徵的整體變異數中位數。特徵為數值型欄位,但排除 click 欄、banner_posdevice_type,以及上一課中的 search_engine_typeproduct_typeadvertiser_type,因為它們其實是類別型欄位。接著,將對變異數高於中位數的這些欄位套用對數正規化,並檢查結果。

pandas 模組已在你的工作環境中以 pd 使用,範例 DataFrame 已載入為 df

本練習屬於課程

用 Python 透過機器學習預測 CTR

檢視課程

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Select numeric columns and print variance
num_df = df.____(include=['int', 'float'])
filter_cols = ['click', 'banner_pos', 'device_type',
               'search_engine_type', 'product_type', 'advertiser_type']
new_df = num_df[num_df.columns[~num_df.columns.____(filter_cols)]]
median = new_df.____.____
print(median)
編輯並執行程式碼