Spara förbehandlade datamängder
Som en del av ditt projekt med en kundtjänstchatbot har du nu förberett en datamängd för finjustering av en Llama-modell. Nästa steg är att spara datamängden så att du kan läsa in den igen senare utan att behöva upprepa förbehandlingsstegen. Det gör att ditt team kan återanvända datamängden i flera experiment och iterationer.
Den här övningen är en del av kursen
Finjustering med Llama 3
Övningsinstruktioner
- Spara den förbehandlade datamängden
dstill disk. - Läs in den sparade datamängden i en ny variabel
ds_preprocessed. - Skriv ut det första elementet i
ds_preprocessed.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
from datasets import load_from_disk
# Save the dataset to disk
____
# Load the dataset from disk
ds_preprocessed = ____
# Print the first element of the loaded dataset
print(____)