Rastgele test veri kümeleri oluşturma
Daha gelişmiş bir kredi verme modeli kurmadan önce, kredi verilerinin bir kısmını ayırmak, modelin gelecekteki kredi başvuru sahiplerinin sonuçlarını ne kadar iyi tahmin edeceğini simüle etmek açısından önemlidir.
Aşağıdaki görselde gösterildiği gibi, gözlemlerin %75'ini eğitim, %25'ini ise modelin test edilmesi için kullanabilirsin.

sample() fonksiyonu, eğitim setine dahil edilecek rastgele bir satır örneği üretmek için kullanılabilir. Yapman gereken tek şey toplam gözlem sayısını ve eğitim için gereken gözlem sayısını sağlamaktır.
Ortaya çıkan satır kimlikleri (ID'leri) vektörünü kullanarak kredileri eğitim ve test veri kümelerine alt kümeleyebilirsin. loans veri kümesi kullanımın için hazır.
Bu egzersiz, kursun bir parçasıdır
R'de Supervised Learning: Sınıflandırma
Egzersiz talimatları
loansveri kümesinde kaç gözlem olduğunu ve %75'lik bir örnek için kaç taneye ihtiyaç olduğunu belirlemek içinnrow()fonksiyonunu uygula.- %75'lik örnek için satır kimliklerinden oluşan bir tam sayı vektörü oluşturmak üzere
sample()fonksiyonunu kullan.sample()'ın ilk argümanı veri kümesindeki satır sayısı, ikincisi ise eğitim setinde ihtiyaç duyduğun satır sayısı olmalıdır. - Satır kimliklerini kullanarak
loansverisini alt kümeleyip eğitim veri kümesini oluştur. Bunuloans_trainolarak kaydet. loansverisini tekrar alt kümele, ama bu kezsample_rowsiçinde OLMAYAN tüm satırları seç. Bunuloans_testolarak kaydet.
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Determine the number of rows for training
# Create a random sample of row IDs
sample_rows <- sample(___, ___)
# Create the training dataset
loans_train <- loans[___]
# Create the test dataset
loans_test <- loans[___]