Вибір рядків: loc[] vs iloc[]
Велика частина роботи з датафреймами — це пошук конкретних записів у наборі даних. Рядки можна знайти двома способами:
- За конкретним значенням стовпця (ознаки).
- За індексом рядків (index). У цій вправі ми зосередимося на другому способі.
Якщо ви вже працювали з pandas, то знайомі з індексаторами .loc і .iloc, які означають відповідно «location» та «index location». У більшості випадків індекси збігатимуться з позицією кожного рядка в датафреймі (наприклад, рядок з індексом 13 буде 14‑м записом).
Хоча обидва індексатори можна використати для однакових завдань, нас цікавить, який з них швидший з погляду продуктивності.
Ця вправа є частиною курсу
Ефективне програмування з pandas
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Define the range of rows to select: row_nums
row_nums = range(0, 1000)
# Select the rows using .loc[] and row_nums and record the time before and after
loc_start_time = time.time()
rows = poker_hands.____[____]
loc_end_time = ___
# Print the time it took to select the rows using .loc[]
print("Time using .loc[]: {} sec".format(___ - ___))