Comece agoraComece grátis

Filtrando conjuntos de dados para avaliação

Você está criando um pipeline de treinamento e avaliação para o chatbot de saúde da sua empresa, usado por hospitais para receber novos pacientes.

Sua tarefa é criar um pipeline para carregar o MedQuad-MedicalQnADataset e avaliar um LLM em sua capacidade de responder a perguntas médicas. Você deve carregar o conjunto de dados na variável ds e incluir apenas as primeiras 500 amostras da divisão train do conjunto de dados armazenado em dataset_name como seu conjunto de avaliação.

Este exercicio faz parte do curso

Ajuste Fino com Llama 3

Ver curso

Instruções do exercicio

  • Importe as funções e classes necessárias de datasets.
  • Carregue o conjunto de dados na variável ds.
  • Manipule ds para incluir as primeiras 500 amostras da divisão train do conjunto de dados armazenado em dataset_name como seu conjunto de avaliação.

exercicio interativo prático

Tente este exercicio completando este código de exemplo.

# Load neccesary imports from library
from datasets import ____, ____

# Load the training split of the dataset
ds = load_dataset(dataset_name, split=____)

# Filter for the first 500 samples of the dataset
filtered_ds = ____
Editar e Executar Código