BaşlayınÜcretsiz başlayın

Rastgele test veri kümeleri oluşturma

Daha gelişmiş bir kredi verme modeli kurmadan önce, kredi verilerinin bir kısmını ayırmak, modelin gelecekteki kredi başvuru sahiplerinin sonuçlarını ne kadar iyi tahmin edeceğini simüle etmek açısından önemlidir.

Aşağıdaki görselde gösterildiği gibi, gözlemlerin %75'ini eğitim, %25'ini ise modelin test edilmesi için kullanabilirsin.

sample() fonksiyonu, eğitim setine dahil edilecek rastgele bir satır örneği üretmek için kullanılabilir. Yapman gereken tek şey toplam gözlem sayısını ve eğitim için gereken gözlem sayısını sağlamaktır.

Ortaya çıkan satır kimlikleri (ID'leri) vektörünü kullanarak kredileri eğitim ve test veri kümelerine alt kümeleyebilirsin. loans veri kümesi kullanımın için hazır.

Bu egzersiz, kursun bir parçasıdır

R'de Supervised Learning: Sınıflandırma

Kursa Göz Atın

Egzersiz talimatları

  • loans veri kümesinde kaç gözlem olduğunu ve %75'lik bir örnek için kaç taneye ihtiyaç olduğunu belirlemek için nrow() fonksiyonunu uygula.
  • %75'lik örnek için satır kimliklerinden oluşan bir tam sayı vektörü oluşturmak üzere sample() fonksiyonunu kullan. sample()'ın ilk argümanı veri kümesindeki satır sayısı, ikincisi ise eğitim setinde ihtiyaç duyduğun satır sayısı olmalıdır.
  • Satır kimliklerini kullanarak loans verisini alt kümeleyip eğitim veri kümesini oluştur. Bunu loans_train olarak kaydet.
  • loans verisini tekrar alt kümele, ama bu kez sample_rows içinde OLMAYAN tüm satırları seç. Bunu loans_test olarak kaydet.

Uygulamalı etkileşimli egzersiz

Bu egzersizi bu örnek kodu tamamlayarak deneyin.

# Determine the number of rows for training


# Create a random sample of row IDs
sample_rows <- sample(___, ___)

# Create the training dataset
loans_train <- loans[___]

# Create the test dataset
loans_test <- loans[___]
Kodu Düzenle ve Çalıştır