开始使用免费开始使用

保存预处理后的数据集

在客户服务聊天机器人项目中,您已经准备好了用于微调 Llama 模型的数据集。下一步是将该数据集保存下来,这样您就可以在之后直接加载,而无需重复预处理步骤。这样做还能让您的团队在多轮实验和迭代中重复使用该数据集。

本练习是课程的一部分

使用 Llama 3 进行微调

查看课程

练习说明

  • 将预处理后的数据集 ds 保存到磁盘。
  • 将保存的数据集加载到新变量 ds_preprocessed 中。
  • 打印 ds_preprocessed 的第一个元素。

交互式实操练习

通过完成这段示例代码来试试这个练习。

from datasets import load_from_disk

# Save the dataset to disk
____

# Load the dataset from disk
ds_preprocessed = ____

# Print the first element of the loaded dataset
print(____)
编辑并运行代码