Menambahkan data ke koleksi
Saatnya menambahkan film dan acara TV Netflix ke koleksi Anda! Anda telah disediakan daftar ID dokumen dan teks, masing-masing disimpan dalam ids dan documents, yang diekstrak dari netflix_titles.csv menggunakan kode berikut:
ids = []
documents = []
with open('netflix_titles.csv') as csvfile:
reader = csv.DictReader(csvfile)
for i, row in enumerate(reader):
ids.append(row['show_id'])
text = f"Title: {row['title']} ({row['type']})\nDescription: {row['description']}\nCategories: {row['listed_in']}"
documents.append(text)
Sebagai contoh informasi yang akan di-embed, berikut dokumen pertama dari documents:
Title: Dick Johnson Is Dead (Movie)
Description: As her father nears the end of his life, filmmaker Kirsten Johnson stages his death in inventive and comical ways to help them both face the inevitable.
Categories: Documentaries
Semua fungsi dan paket yang diperlukan telah diimpor, dan sebuah klien persisten telah dibuat serta ditetapkan ke client.
Latihan ini merupakan bagian dari kursus
Pengantar Embeddings dengan OpenAI API
Instruksi latihan
- Buat ulang koleksi
netflix_titlesAnda. - Tambahkan dokumen dan ID-nya ke koleksi.
- Cetak jumlah dokumen dalam
collectiondan sepuluh item pertama.
Latihan interaktif langsung praktik
Cobalah latihan ini dengan melengkapi kode contoh ini.
# Recreate the netflix_titles collection
collection = client.____(
name="netflix_titles",
embedding_function=OpenAIEmbeddingFunction(model_name="text-embedding-3-small", api_key="")
)
# Add the documents and IDs to the collection
____
# Print the collection size and first ten items
print(f"No. of documents: {____}")
print(f"First ten documents: {____}")