Створення текстових фрагментів
Текст із твору Ромео і Джульєтта завантажено до лексичного графа зі структурою дій і сцен, але він усе ще завеликий, щоб згенерувати змістовні вкладення (embeddings — векторні представлення). Доповніть код, щоб розбити текст з Дії I, Сцени I на менші фрагменти для кожної репліки.
Функція visualize_graph() відобразить вузли та зв'язки в документі-графі.
Ця вправа є частиною курсу
Graph RAG з LangChain і Neo4j
Інструкції до вправи
- Додайте кожен
line_nodeдо об'єктаgraph_document. - Створіть зв'язки
HAS_LINEіSPOKEN_BYміж кожноюsceneіline_node, а також міжline_nodeіcharacterвідповідно, і додайте їх доgraph_document.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
graph_document = GraphDocument(nodes=[scene], relationships=[])
characters = {}
for i, line in enumerate(lines[20:40]):
character, text = get_character_and_line(line)
line_node = Node(type="Line", id=f"{scene.id}-line-{i}", properties={"raw": line,"character": character, "text": text, "caption": f"{text[:15]}..."})
if character not in characters:
character_node = Node(type="Character", id=character, properties={"name": character})
characters[character] = character_node
graph_document.nodes.append(character_node)
# Add nodes to the array
graph_document.____.append(____)
# Add relationship to the array
graph_document.____.extend(
[Relationship(source=scene, target=line_node, type="____"),
Relationship(source=line_node, target=characters[character], type="SPOKEN_BY")]
)
visualize_graph(graph_document)