ÎncepețiÎncepe gratuit

Adăugarea datelor în colecție

E momentul să adaugi filmele și serialele Netflix în colecția ta! Ai la dispoziție o listă de ID-uri de documente și texte, stocate în ids, respectiv documents, extrase din netflix_titles.csv folosind următorul cod:

ids = []
documents = []

with open('netflix_titles.csv') as csvfile:
  reader = csv.DictReader(csvfile)
  for i, row in enumerate(reader):
    ids.append(row['show_id'])
    text = f"Title: {row['title']} ({row['type']})\nDescription: {row['description']}\nCategories: {row['listed_in']}"
    documents.append(text)

Ca exemplu al informațiilor care vor fi încorporate (embedded), iată primul document din documents:

Title: Dick Johnson Is Dead (Movie)
Description: As her father nears the end of his life, filmmaker Kirsten Johnson stages his death in inventive and comical ways to help them both face the inevitable.
Categories: Documentaries

Toate funcțiile și pachetele necesare au fost importate, iar un client persistent a fost creat și atribuit variabilei client.

Acest exercițiu face parte din cursul

Introducere în Embeddings cu API-ul OpenAI

Vezi cursul

Instrucțiuni pentru exercițiu

  • Recreează colecția netflix_titles.
  • Adaugă documentele și ID-urile lor în colecție.
  • Afișează numărul de documente din collection și primele zece elemente.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Recreate the netflix_titles collection
collection = client.____(
  name="netflix_titles",
  embedding_function=OpenAIEmbeddingFunction(model_name="text-embedding-3-small", api_key="")
)

# Add the documents and IDs to the collection
____

# Print the collection size and first ten items
print(f"No. of documents: {____}")
print(f"First ten documents: {____}")
Editează și rulează codul