開始使用免費開始

撰寫疊代器以分批載入資料(1)

另一種把過大而無法一次放入記憶體的資料分批讀取的方法,是把檔案讀成指定筆數長度的 DataFrame,例如 100。舉例來說,使用 pandas 套件(以 pd 匯入)時,可以寫 pd.read_csv(filename, chunksize=100)。這會建立一個可疊代的「reader 物件」,也就是說,你可以對它使用 next()

在本練習中,你會用 read_csv() 以小型的 DataFrame 區塊來讀取檔案。你將使用目前目錄中的世界銀行指標資料 'ind_pop.csv',來查看多個國家與年份的都會人口指標。

本練習屬於課程

Python 工具箱

檢視課程

練習說明

  • 使用 pd.read_csv() 以每批 10 筆的大小讀入 'ind_pop.csv'。將結果指定給 df_reader
  • 列印 df_reader 的前兩個批次。

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Import the pandas package
import pandas as pd

# Initialize reader object: df_reader
df_reader = ____(____, ____)

# Print two chunks
print(____)
print(____)
編輯並執行程式碼