开始使用免费开始使用

为 RAG 加载 PDF 文件

要开始实现 Retrieval Augmented Generation(RAG,检索增强生成),您首先需要加载模型将要访问的文档。文档来源多样,LangChain 为其中许多来源都提供了文档加载器。

在本练习中,您将使用文档加载器来加载一份 PDF 文档,其中包含 Lewis 等人在 2021 年发表的论文《Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks》(面向知识密集型 NLP 任务的检索增强生成)。该文件已为您提供,文件名为 'rag_paper.pdf'

注意:用于在 LangChain 中加载 PDF 文档的依赖项 pypdf 已为您安装完毕。

本练习是课程的一部分

使用 LangChain 的 Retrieval Augmented Generation (RAG)

查看课程

练习说明

  • 在 LangChain 中导入用于加载 PDF 文档的相应类。
  • 'rag_paper.pdf' 文档创建一个文档加载器。
  • 将文档加载到内存中,以查看第一个文档(或页面)的内容。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Import library
from langchain_community.document_loaders import ____

# Create a document loader for rag_paper.pdf
loader = ____

# Load the document
data = ____
print(data[0])
编辑并运行代码