НачатьНачать бесплатно

Случайная выборка строк

В этом упражнении вы сравните два метода случайного выбора строк (записей) с возвращением из DataFrame библиотеки pandas:

  • Встроенную функцию pandas.sample()
  • Генератор случайных целых чисел NumPynp.random.randint()

В статистике и машинном обучении принято обучать алгоритм на 75% доступных данных, а затем проверять его качество на оставшихся 25%.

В этом упражнении вы случайным образом выберете 75% всех имеющихся комбинаций покерных карт, используя каждый из указанных методов, и определите, какой из них работает быстрее.

Это упражнение является частью курса

Эффективная работа с pandas

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Extract number of rows in dataset
N=poker_hands.shape[0]

# Select and time the selection of the 75% of the dataset's rows
rand_start_time = time.time()
poker_hands.iloc[np.random.randint(____=0, high=____, ____=int(0.75 * N))]
print("Time using Numpy: {} sec".format(time.time() - rand_start_time))
Редактировать и запускать код