埋め込まれた説明の可視化
商品説明から埋め込みを作成できたので、次はそのデータを探索してみましょう。t-SNE を使って、埋め込みデータの次元数を1,536から2に削減します。これにより、データを可視化しやすくなります。
前の演習で使用した products という辞書のリストから始めましょう。このリストには商品情報と 'short_description' から作成した埋め込みが含まれています。参考として、products のプレビューを以下に示します。
products = [
{
"title": "Smartphone X1",
"short_description": "The latest flagship smartphone with AI-powered features and 5G connectivity.",
"price": 799.99,
"category": "Electronics",
"features": [
"6.5-inch AMOLED display",
"Quad-camera system with 48MP main sensor",
"Face recognition and fingerprint sensor",
"Fast wireless charging"
],
"embedding": [-0.014650369994342327, ..., 0.008677126839756966]
},
...
]
matplotlib.pyplot と numpy はそれぞれ plt と np としてインポート済みです。
この演習はコースの一部です
OpenAI API で学ぶ埋め込み入門
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Create categories and embeddings lists using list comprehensions
categories = [product[____] for product in products]
embeddings = [product[____] for product in products]