Bắt đầu ngayBắt đầu miễn phí

Fine-tuning CV: chuẩn bị dữ liệu

Trong bài tập này, bạn sẽ chuẩn bị Stanford Cars dataset cho việc huấn luyện. Bạn sẽ sử dụng thư viện datasets để chia tập dữ liệu và áp dụng các phép biến đổi tiền xử lý. Dataset gồm 8k ảnh có nhãn của 196 mẫu xe:

an example car from the dataset

Dataset đã được nạp dưới tên dataset. Các phép biến đổi đã được định nghĩa sẵn là transforms, bao gồm chuẩn hóa lại và chuyển đổi kiểu dữ liệu.

Bài tập này là một phần của khóa học

Mô hình đa phương thức với Hugging Face

Xem khóa học

Hướng dẫn bài tập

  • Tạo phép chia train/test 80/20 từ dataset bằng phương thức .train_test_split().
  • Áp dụng các phép biến đổi (transforms) lên data_splits.
  • Vẽ ảnh đã tăng cường từ bộ pixel đầu tiên trong dataset_transformed.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Create a train/test split within the HF dataset
data_splits = ____(test_size=____, seed=42)

# Apply the transformations
dataset_transformed = ____

# Plot the transformed image
plt.imshow(dataset_transformed["train"][0]["____"].permute(1, 2, 0))
plt.show()
Chỉnh sửa và Chạy Mã