PyTorch DataLoader
Bon travail pour la définition de la classe Dataset ! Le WaterDataset que vous venez de créer est maintenant prêt à être utilisé.
L'étape suivante pour préparer les données d'entraînement consiste à configurer un DataLoader. Un DataLoader de PyTorch peut être créé à partir d'un Dataset pour charger les données, les diviser en lots (batches) et effectuer, au besoin, des transformations. Il fournit ensuite un échantillon de données prêt pour l'entraînement.
Dans cet exercice, vous allez construire un DataLoader à partir de WaterDataset. La classe DataLoader dont vous aurez besoin a déjà été importée pour vous depuis torch.utils.data. Allons-y !
Cette activité fait partie du cours
Apprentissage profond intermédiaire avec PyTorch
Instructions de l’exercice
- Créez une instance de
WaterDatasetà partir dewater_train.csvet assignez-la àdataset_train. - Créez
dataloader_trainà partir dedataset_train, en utilisant une taille de lot (batch size) de deux et en mélangeant les échantillons (shuffle). - Récupérez un lot de caractéristiques (features) et d'étiquettes (labels) à partir du DataLoader et affichez-les.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Create an instance of the WaterDataset
dataset_train = ____(____)
# Create a DataLoader based on dataset_train
dataloader_train = ____(
____,
batch_size=____,
shuffle=____,
)
# Get a batch of features and labels
features, labels = ____
print(features, labels)