Kom igångKom igång gratis

Lägga till data i samlingen

Dags att lägga till Netflix-filmer och TV-serier i din samling! Du har fått en lista med dokument-ID:n och texter, lagrade i ids respektive documents, som har extraherats från netflix_titles.csv med följande kod:

ids = []
documents = []

with open('netflix_titles.csv') as csvfile:
  reader = csv.DictReader(csvfile)
  for i, row in enumerate(reader):
    ids.append(row['show_id'])
    text = f"Title: {row['title']} ({row['type']})\nDescription: {row['description']}\nCategories: {row['listed_in']}"
    documents.append(text)

Som exempel på vilken information som kommer att bäddas in visas här det första dokumentet från documents:

Title: Dick Johnson Is Dead (Movie)
Description: As her father nears the end of his life, filmmaker Kirsten Johnson stages his death in inventive and comical ways to help them both face the inevitable.
Categories: Documentaries

Alla nödvändiga funktioner och paket har importerats, och en persistent klient har skapats och tilldelats client.

Den här övningen är en del av kursen

Introduktion till inbäddningar med OpenAI API

Visa kurs

Övningsinstruktioner

  • Återskapa din netflix_titles-samling.
  • Lägg till dokumenten och deras ID:n i samlingen.
  • Skriv ut antalet dokument i collection och de första tio objekten.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Recreate the netflix_titles collection
collection = client.____(
  name="netflix_titles",
  embedding_function=OpenAIEmbeddingFunction(model_name="text-embedding-3-small", api_key="")
)

# Add the documents and IDs to the collection
____

# Print the collection size and first ten items
print(f"No. of documents: {____}")
print(f"First ten documents: {____}")
Redigera och kör kod