ÎncepețiÎncepe gratuit

Filtrarea după metadate

Metadatele disponibile în baza de date îți permit să filtrezi mai ușor rezultatele în funcție de condiții suplimentare. Imaginează-ți că recomandările de filme pe care le-ai creat pot accesa preferințele setate de utilizator și le pot folosi pentru a rafina și mai mult rezultatele.

În acest exercițiu, vei folosi metadate suplimentare pentru a filtra recomandările de filme Netflix. Colecția netflix_titles a fost actualizată pentru a adăuga metadate fiecărui titlu, inclusiv 'rating' – clasificarea pe categorii de vârstă – și 'release_year' – anul în care titlul a fost lansat inițial.

Iată o previzualizare a unui element actualizat:

{'ids': ['s999'],
 'embeddings': None,
 'metadatas': [{'rating': 'TV-14', 'release_year': 2021}],
 'documents': ['Title: Searching For Sheela (Movie)\nDescription: Journalists and fans await Ma Anand Sheela as the infamous former Rajneesh commune's spokesperson returns to India after decades for an interview tour.\nCategories: Documentaries, International Movies'],
 'uris': None,
 'data': None}

Acest exercițiu face parte din cursul

Introducere în Embeddings cu API-ul OpenAI

Vezi cursul

Instrucțiuni pentru exercițiu

  • Interoghează două rezultate din colecție folosind reference_texts.
  • Filtrează rezultatele pentru titlurile cu clasificarea 'G' care au fost lansate înainte de 2019.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

collection = client.get_collection(
  name="netflix_titles",
  embedding_function=OpenAIEmbeddingFunction(model_name="text-embedding-3-small", api_key="")
)

reference_texts = ["children's story about a car", "lions"]

# Query two results using reference_texts
result = collection.query(
  ____,
  ____,
  # Filter for titles with a G rating released before 2019
  ____={
    ____: [
        {"____": 
        	{____}
        },
        {"____": 
         	{____}
        }
    ]
  }
)

print(result['documents'])
Editează și rulează codul