НачатьНачать бесплатно

Создание итератора для загрузки данных по частям (1)

Ещё один способ работать с данными, которые не помещаются в памяти, — читать файл частями в виде DataFrame заданного размера, например по 100 строк. С помощью библиотеки pandas (импортированной как pd) это делается так: pd.read_csv(filename, chunksize=100). В результате создаётся итерируемый объект reader, к которому можно применять next().

В этом упражнении вы будете считывать файл небольшими частями в виде DataFrame с помощью read_csv(). Для этого используйте файл с данными World Bank Indicators 'ind_pop.csv', который находится в вашей текущей директории. Вы изучите показатель городского населения для разных стран и лет.

Это упражнение является частью курса

Инструментарий Python

Посмотреть курс

Инструкции к упражнению

  • Используйте pd.read_csv(), чтобы считать файл 'ind_pop.csv' частями по 10 строк. Сохраните результат в переменную df_reader.
  • Выведите на экран первые две части из df_reader.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Import the pandas package
import pandas as pd

# Initialize reader object: df_reader
df_reader = ____(____, ____)

# Print two chunks
print(____)
print(____)
Редактировать и запускать код