НачатьНачать бесплатно

Создание многоуровневых индексов

Индексы также можно формировать из нескольких столбцов — такой индекс называется многоуровневым (или иерархическим). У этого подхода есть свои преимущества и недостатки.

Преимущество состоит в том, что многоуровневые индексы упрощают работу с вложенными категориальными переменными. Например, в клиническом исследовании участники делятся на контрольную и экспериментальную группы: каждый испытуемый принадлежит одной из групп, то есть является вложенным элементом внутри группы. Аналогично в наборе данных о температурах каждый город находится внутри определённой страны.

Основной недостаток заключается в том, что код для работы с индексами отличается от кода для работы со столбцами. Придётся освоить два синтаксиса и следить за тем, как представлены данные.

pandas загружен как pd. Набор данных temperatures доступен.

Это упражнение является частью курса

Работа с данными в pandas

Посмотреть курс

Инструкции к упражнению

  • Задайте индекс для temperatures на основе столбцов "country" и "city" и сохраните результат в temperatures_ind.
  • Укажите две пары страна/город для выборки: "Brazil"/"Rio De Janeiro" и "Pakistan"/"Lahore", присвоив их переменной rows_to_keep.
  • Выведите и отфильтруйте temperatures_ind по rows_to_keep с помощью .loc[].

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Index temperatures by country & city
temperatures_ind = ____

# List of tuples: Brazil, Rio De Janeiro & Pakistan, Lahore
rows_to_keep = [____]

# Subset for rows to keep
print(temperatures_ind.____)
Редактировать и запускать код