移除稀疏詞彙
在稀疏矩陣上執行分類模型可能非常耗費運算資源。若沒有 GPU 或雲端運算資源,你在本機電腦上可能會遇到時間與記憶體的限制。現在你拿到一個文件-詞彙矩陣,並計畫執行多種演算法來找到最佳的分類模型。在這個練習中,你會以不同的稀疏程度,從提供的矩陣 matrix 中移除部分稀疏詞彙。
對於每個稀疏程度,請記下矩陣中剩餘的詞彙數量。
本練習屬於課程
R 的自然語言處理入門
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
less_sparse_matrix <-
___(___, sparse = ___)
# Print results
matrix
less_sparse_matrix