Skriva en generator för att läsa in data i delar (3)
Bra jobbat! Du har precis skapat en generatorfunktion som du kan använda för att bearbeta stora filer.
Nu ska vi använda din generatorfunktion för att bearbeta World Bank-datamängden, precis som du gjorde tidigare. Du kommer att läsa filen rad för rad och skapa ett lexikon över hur många gånger varje land förekommer i en kolumn i datamängden. Den här gången bearbetar du inte bara 1 000 rader – du kör igenom hela datamängden!
Generatorfunktionen read_large_file() och CSV-filen 'world_dev_ind.csv' är förinstallerade och redo att användas. Kör på!
Den här övningen är en del av kursen
Python Toolbox
Övningsinstruktioner
- Bind filen
'world_dev_ind.csv'tillfilei kontexthanteraren medopen(). - Komplettera
for-loopen så att den itererar över generatorn från anropet tillread_large_file()för att bearbeta alla rader i filen.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Initialize an empty dictionary: counts_dict
counts_dict = {}
# Open a connection to the file
with ____ as ____:
# Iterate over the generator from read_large_file()
for line in ____:
row = line.split(',')
first_col = row[0]
if first_col in counts_dict.keys():
counts_dict[first_col] += 1
else:
counts_dict[first_col] = 1
# Print
print(counts_dict)