Aktualizace a mazání položek v kolekci
To, že jsou dokumenty uložené ve vektorové databázi, neznamená, že je nemůžeš měnit — klidně přidávej nové položky nebo aktualizuj ty stávající.
V tomto cvičení máš k dispozici dva nové Netflix tituly uložené v new_data:
[{"id": "s1001", "document": "Title: Cats & Dogs (Movie)\nDescription: A look at the top-secret, high-tech espionage war going on between cats and dogs, of which their human owners are blissfully unaware."},
{"id": "s6884", "document": 'Title: Goosebumps 2: Haunted Halloween (Movie)\nDescription: Three teens spend their Halloween trying to stop a magical book, which brings characters from the "Goosebumps" novels to life.\nCategories: Children & Family Movies, Comedies'}]
Tato ID buď přidáš, nebo aktualizuješ v databázi — podle toho, jestli už v kolekci existují.
Toto cvičení je součástí kurzu
Introduction to Embeddings with the OpenAI API
Pokyny k cvičení
- Extrahuj ID a dokumenty z
new_dataa pomocí jediné metody je v kolekcinetflix_titlesaktualizuj (pokud už existují) nebo přidej (pokud zatím neexistují). - Po přidání či aktualizaci položek odstraň položku s ID
's95'.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
collection = client.get_collection(
name="netflix_titles",
embedding_function=OpenAIEmbeddingFunction(model_name="text-embedding-3-small", api_key="")
)
# Update or add the new documents
____(
ids=____,
documents=____
)
# Delete the item with ID "s95"
____
result = collection.query(
query_texts=["films about dogs"],
n_results=3
)
print(result)