Создание итератора для загрузки данных по частям (1)
Ещё один способ работать с данными, которые не помещаются в памяти, — читать файл частями в виде DataFrame заданного размера, например по 100 строк. С помощью библиотеки pandas (импортированной как pd) это делается так: pd.read_csv(filename, chunksize=100). В результате создаётся итерируемый объект reader, к которому можно применять next().
В этом упражнении вы будете считывать файл небольшими частями в виде DataFrame с помощью read_csv(). Для этого используйте файл с данными World Bank Indicators 'ind_pop.csv', который находится в вашей текущей директории. Вы изучите показатель городского населения для разных стран и лет.
Это упражнение является частью курса
Инструментарий Python
Инструкции к упражнению
- Используйте
pd.read_csv(), чтобы считать файл'ind_pop.csv'частями по 10 строк. Сохраните результат в переменнуюdf_reader. - Выведите на экран первые две части из
df_reader.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Import the pandas package
import pandas as pd
# Initialize reader object: df_reader
df_reader = ____(____, ____)
# Print two chunks
print(____)
print(____)