Aggiungere dati alla collection
È il momento di aggiungere quei film e serie TV di Netflix alla tua collection! Ti è stata fornita una lista di ID di documento e testi, salvati rispettivamente in ids e documents, estratti da netflix_titles.csv usando il seguente codice:
ids = []
documents = []
with open('netflix_titles.csv') as csvfile:
reader = csv.DictReader(csvfile)
for i, row in enumerate(reader):
ids.append(row['show_id'])
text = f"Title: {row['title']} ({row['type']})\nDescription: {row['description']}\nCategories: {row['listed_in']}"
documents.append(text)
Ecco, come esempio di ciò che verrà incorporato, il primo documento di documents:
Title: Dick Johnson Is Dead (Movie)
Description: As her father nears the end of his life, filmmaker Kirsten Johnson stages his death in inventive and comical ways to help them both face the inevitable.
Categories: Documentaries
Tutte le funzioni e i pacchetti necessari sono già stati importati, e un client persistente è stato creato e assegnato a client.
Questo esercizio fa parte del corso
Introduzione agli Embeddings con l'API di OpenAI
Istruzioni dell'esercizio
- Ricrea la tua collection
netflix_titles. - Aggiungi i documenti e i loro ID alla collection.
- Stampa il numero di documenti in
collectione i primi dieci elementi.
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
# Recreate the netflix_titles collection
collection = client.____(
name="netflix_titles",
embedding_function=OpenAIEmbeddingFunction(model_name="text-embedding-3-small", api_key="")
)
# Add the documents and IDs to the collection
____
# Print the collection size and first ten items
print(f"No. of documents: {____}")
print(f"First ten documents: {____}")