Случайная выборка строк
В этом упражнении вы сравните два метода случайного выбора строк (записей) с возвращением из DataFrame библиотеки pandas:
- Встроенную функцию
pandas—.sample() - Генератор случайных целых чисел
NumPy—np.random.randint()
В статистике и машинном обучении принято обучать алгоритм на 75% доступных данных, а затем проверять его качество на оставшихся 25%.
В этом упражнении вы случайным образом выберете 75% всех имеющихся комбинаций покерных карт, используя каждый из указанных методов, и определите, какой из них работает быстрее.
Это упражнение является частью курса
Эффективная работа с pandas
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Extract number of rows in dataset
N=poker_hands.shape[0]
# Select and time the selection of the 75% of the dataset's rows
rand_start_time = time.time()
poker_hands.iloc[np.random.randint(____=0, high=____, ____=int(0.75 * N))]
print("Time using Numpy: {} sec".format(time.time() - rand_start_time))