ストリーミングエンジンの使用
シアトル図書館チームとの作業に戻りましょう。貸し出し履歴データが増え続け、クエリがメモリの上限に近づいてきました。最も簡単な解決策は、デフォルトのインメモリエンジンではなく、Polars のストリーミングエンジンを使って遅延クエリを実行することです。
polars は pl としてインポート済みです。LazyFrame monthly_digital はあらかじめ読み込まれており、月ごとのデジタル貸し出し数を集計しています。
この演習はコースの一部です
Polars によるデータパイプラインのスケーリングと最適化
演習の手順
- ストリーミングエンジンを使って
monthly_digitalを実行してください。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Run the query on the streaming engine
result = monthly_digital.collect(____="____")
print(result)