始める無料で始める

データの前処理

あなたは、レストランのレビューをポジティブ・ネガティブ・中間に分類する感情分析プロジェクトで、NLPを活用した機械学習モデルを構築しています。学習用データを準備するために、テキストデータの前処理と数値化が必要です。

データセットには数千件のレビューが含まれており、そのうちの1件は次のように書かれています。

「料理はおいしかったけど、サービスが遅すぎ」

「けど」と 「は」という単語をこの文章から取り除くであろうテキスト前処理のステップはどれでしょう?

この演習はコースの一部です

大規模言語モデル(LLM)の基本

コースを見る

実践的なインタラクティブ演習

理論を実践に変える、インタラクティブな演習のひとつをお試しください

演習を開始する