使用正确的模型结构
问答任务可以是抽取式或生成式,不同类型需要不同的 transformer 结构来正确处理输入与输出。
常用模型包括:
- 仅编码器的模型,例如
"distilbert-base-uncased-distilled-squad" - 仅解码器的模型,例如
"gpt2"
请根据您对常见任务与模型的了解,选择合适的模型。已为您加载了 pipeline,以及关于蒙娜丽莎的文本。
本练习是课程的一部分
Python 中的 LLM 入门
交互式实操练习
通过完成这段示例代码来试试这个练习。
question = "Who painted the Mona Lisa?"
# Define the appropriate model
qa = pipeline(task="question-answering", model=____)
output = qa(question=question, context=text)
print(output['answer'])