保存预处理后的数据集
在客户服务聊天机器人项目中,您已经准备好了用于微调 Llama 模型的数据集。下一步是将该数据集保存下来,这样您就可以在之后直接加载,而无需重复预处理步骤。这样做还能让您的团队在多轮实验和迭代中重复使用该数据集。
本练习是课程的一部分
使用 Llama 3 进行微调
练习说明
- 将预处理后的数据集
ds保存到磁盘。 - 将保存的数据集加载到新变量
ds_preprocessed中。 - 打印
ds_preprocessed的第一个元素。
交互式实操练习
通过完成这段示例代码来试试这个练习。
from datasets import load_from_disk
# Save the dataset to disk
____
# Load the dataset from disk
ds_preprocessed = ____
# Print the first element of the loaded dataset
print(____)