Kom igångKom igång gratis

Skriva en generator för att läsa in data i delar (3)

Bra jobbat! Du har precis skapat en generatorfunktion som du kan använda för att bearbeta stora filer.

Nu ska vi använda din generatorfunktion för att bearbeta World Bank-datamängden, precis som du gjorde tidigare. Du kommer att läsa filen rad för rad och skapa ett lexikon över hur många gånger varje land förekommer i en kolumn i datamängden. Den här gången bearbetar du inte bara 1 000 rader – du kör igenom hela datamängden!

Generatorfunktionen read_large_file() och CSV-filen 'world_dev_ind.csv' är förinstallerade och redo att användas. Kör på!

Den här övningen är en del av kursen

Python Toolbox

Visa kurs

Övningsinstruktioner

  • Bind filen 'world_dev_ind.csv' till file i kontexthanteraren med open().
  • Komplettera for-loopen så att den itererar över generatorn från anropet till read_large_file() för att bearbeta alla rader i filen.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Initialize an empty dictionary: counts_dict
counts_dict = {}

# Open a connection to the file
with ____ as ____:

    # Iterate over the generator from read_large_file()
    for line in ____:

        row = line.split(',')
        first_col = row[0]

        if first_col in counts_dict.keys():
            counts_dict[first_col] += 1
        else:
            counts_dict[first_col] = 1

# Print            
print(counts_dict)
Redigera och kör kod