Fine-tuning CV: chuẩn bị dữ liệu
Trong bài tập này, bạn sẽ chuẩn bị Stanford Cars dataset cho việc huấn luyện. Bạn sẽ sử dụng thư viện datasets để chia tập dữ liệu và áp dụng các phép biến đổi tiền xử lý. Dataset gồm 8k ảnh có nhãn của 196 mẫu xe:

Dataset đã được nạp dưới tên dataset. Các phép biến đổi đã được định nghĩa sẵn là transforms, bao gồm chuẩn hóa lại và chuyển đổi kiểu dữ liệu.
Bài tập này là một phần của khóa học
Mô hình đa phương thức với Hugging Face
Hướng dẫn bài tập
- Tạo phép chia train/test 80/20 từ
datasetbằng phương thức.train_test_split(). - Áp dụng các phép biến đổi (
transforms) lêndata_splits. - Vẽ ảnh đã tăng cường từ bộ pixel đầu tiên trong
dataset_transformed.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Create a train/test split within the HF dataset
data_splits = ____(test_size=____, seed=42)
# Apply the transformations
dataset_transformed = ____
# Plot the transformed image
plt.imshow(dataset_transformed["train"][0]["____"].permute(1, 2, 0))
plt.show()