İşleme süresi veri boyutuna göre nasıl değişir?
İki veri kümesindeki tüm öğeleri işliyorsan ve bunlardan biri daha büyükse, daha büyük olanı daha uzun sürede işler. Ancak, ne kadar daha uzun süreceğinin her zaman boyutuyla birebir orantılı olmadığını bilmek önemli. Yani, iki veri kümesinden biri diğerinin iki katı boyuttaysa, mutlaka iki kat uzun sürede işlenecek diye bir garanti yok. 1,5 kat da sürebilir, dört kat da sürebilir. Bu, veri kümesini işlerken hangi işlemleri kullandığına bağlıdır.
Bu egzersizde, Writing Efficient R Code course içerisinde ele alınan microbenchmark paketini kullanacaksın.
Not: Sayılar bilimsel gösterimle yazılmıştır $$1e5 = 1 * 10^5 = 100,000$$
Bu egzersiz, kursun bir parçasıdır
R'de Ölçeklenebilir Veri İşleme
Egzersiz talimatları
microbenchmarkpaketini yükle.- Rastgele vektörlerin sıralama sürelerini karşılaştırmak için
microbenchmark()fonksiyonunu kullan. mbüzerindeplot()çağır.
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Load the microbenchmark package
___
# Compare the timings for sorting different sizes of vector
mb <- ___(
# Sort a random normal vector length 1e5
"1e5" = sort(rnorm(1e5)),
# Sort a random normal vector length 2.5e5
"2.5e5" = sort(rnorm(2.5e5)),
# Sort a random normal vector length 5e5
"5e5" = sort(rnorm(5e5)),
"7.5e5" = sort(rnorm(7.5e5)),
"1e6" = sort(rnorm(1e6)),
times = 10
)
# Plot the resulting benchmark object
___(mb)