惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

人人都是产品经理
人人都是产品经理
有赞技术团队
有赞技术团队
WordPress大学
WordPress大学
月光博客
月光博客
T
Tailwind CSS Blog
阮一峰的网络日志
阮一峰的网络日志
小众软件
小众软件
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Last Week in AI
Last Week in AI
大猫的无限游戏
大猫的无限游戏
S
SegmentFault 最新的问题
罗磊的独立博客
Jina AI
Jina AI
酷 壳 – CoolShell
酷 壳 – CoolShell
宝玉的分享
宝玉的分享
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
博客园 - 三生石上(FineUI控件)
量子位
雷峰网
雷峰网
Apple Machine Learning Research
Apple Machine Learning Research
美团技术团队
博客园 - 聂微东
V
V2EX

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
Neo4j笔记(五):查询的处理流程
哥本哈士奇(aspnetx) · 2026-05-10 · via 博客园_首页

Neo4j笔记(五):查询的处理流程

摘要

上一篇讲述了一篇文章如何通过LLM转换成Cypher,然后在Neo4J里运行,形成知识图谱。此篇接着上篇,继续梳理一个用户查询,如何通过图数据库以及大模型去汇总查询结果。

BTW:刚开始我尝试用langchain封装的方法,但后来发现langchaing的核心库以及对neo4j的封装,接口已经大变,很难对齐颗粒度,所以这里使用的方法是自己梳理的过程。


实现流程

整体流程图

flowchart TD A[用户提问] --> B[获取图谱 Schema] B --> C[LLM 生成 Cypher 查询] C --> D[Neo4j 执行查询] D --> E{查询成功?} E -->|是| F[获取查询结果] E -->|否| G[返回错误信息] F --> H[LLM 增强生成] H --> I[自然语言回答] G --> I style A fill:#f9f,stroke:#333,stroke-width:2px style I fill:#9f9,stroke:#333,stroke-width:2px

详细流程说明

sequenceDiagram participant User as 用户 participant LLM as 大语言模型 participant Neo4j as Neo4j图数据库 User->>LLM: 自然语言问题 + 图谱Schema LLM->>LLM: 生成 Cypher 查询语句 LLM-->>User: Cypher语句 User->>Neo4j: 执行 Cypher 查询 Neo4j-->>User: 返回查询结果 User->>LLM: 问题 + 查询结果 LLM->>LLM: 增强生成(总结回答) LLM-->>User: 自然语言回答

流程

  1. 用户提问 → 2. 获取图谱结构 → 3. 生成 Cypher → 4. 执行查询 → 5. LLM 汇总回答

大模型和图数据库的连接

环境配置

创建 .env 文件:

NEO4J_URL=bolt://localhost:7687
NEO4J_USER=neo4j
NEO4J_PASSWORD=your_password
OPENAI_API_KEY=your_api_key
OPENAI_BASE_URL=https://api.deepseek.com/v1

我这里用的是Deepseek,也可以根据自己的环境选择比如豆包,或者本地Ollama,或者Microsoft Foundry。

大模型调用

from langchain_openai import ChatOpenAI

llm = ChatOpenAI(
    model="deepseek-v4-flash",
    api_key=OPENAI_API_KEY,
    base_url=OPENAI_BASE_URL,
    temperature=0  # 设为 0 提高输出确定性
)

Neo4j 连接

from langchain_neo4j import Neo4jGraph

graph = Neo4jGraph(
    url=NEO4J_URL,
    username=NEO4J_USER,
    password=NEO4J_PASS
)

第一步:文本转知识图谱

核心思想:利用 LLM 将自然语言文本转换为 Cypher 语句,自动创建知识图谱。

def text_to_knowledge_graph(text):
    prompt = f"""
请将以下文本转换为 Neo4j Cypher 语句:

文本:{text}

要求:
1. 识别实体作为节点(Person、Location、Event 等)
2. 识别关系作为边(COOPERATE_WITH、PERFORMED_AT 等)
3. 使用 MERGE 语句避免重复
4. 只输出 Cypher 语句
"""
    cypher = llm.invoke(prompt).content
    # 清理 markdown 代码块标记
    if cypher.startswith('```'):
        cypher = cypher.split('\n', 1)[1].rsplit('\n', 1)[0]
    graph.query(cypher)

正巧昨天跟苏鹏老师聊起了郭德纲,所以这里就用郭德纲和于谦来做示例。

输入文本示例

郭德纲 1973年出生,相声演员,与于谦长期搭档,2005年爆红
于谦 1969年出生,相声演员,擅长捧哏,常年和郭德纲合作

生成的 Cypher

MERGE (g:Person {name: '郭德纲', birth_year: 1973, occupation: '相声演员'})
MERGE (y:Person {name: '于谦', birth_year: 1969, occupation: '相声演员'})
MERGE (g)-[:COOPERATE_WITH]->(y)

生成的知识图谱

img

第二步:获取图谱结构

目的:获取数据库的 schema 信息,为生成准确的 Cypher 查询提供上下文。这个思路跟TEXT2SQL基本是一致的。

这里我选择的是先从APOC插件中获取图谱的schema信息,如果失败,再从Neo4j数据库中获取。由于APOC不是默认被安装的,所以目标Neo4j环境很有可能没有这个插件。

def get_graph_schema():
    # 获取节点标签
    labels = graph.query("CALL db.labels() YIELD label RETURN collect(label)")
    # 获取关系类型
    rels = graph.query("CALL db.relationshipTypes() YIELD relationshipType RETURN collect(relationshipType)")
    # 获取属性键
    props = graph.query("CALL db.propertyKeys() YIELD propertyKey RETURN collect(propertyKey)")
    
    # 尝试使用 APOC(如果安装)
    try:
        apoc_schema = graph.query("CALL apoc.meta.data()")
        return {"labels": labels, "relationships": rels, "properties": props, "apoc": apoc_schema}
    except:
        return {"labels": labels, "relationships": rels, "properties": props}

APOC 安装方法(tar包安装)

  1. 下载对应版本的 APOC jar 文件
  2. 放入 neo4j/plugins/ 目录
  3. 修改 neo4j.conf
    apoc.enabled=true
    apoc.meta.data.allowlist.all=true
    
  4. 重启 Neo4j

第三步:生成 Cypher 查询并汇总增强生成结果

其它方法都已经准备好,最终再通过如下方法做调度:

def query_and_summarize(question):
    # 获取图谱结构
    schema = get_graph_schema()
    
    # 生成 Cypher
    cypher_prompt = f"""
图谱结构:{schema}
用户问题:{question}
请生成 Cypher 查询语句。
"""
    cypher = llm.invoke(cypher_prompt).content
    
    # 执行查询
    result = graph.query(cypher)
    
    # LLM 汇总
    summary = llm.invoke(f"问题:{question}\n结果:{result}\n请用自然语言回答").content
    return summary

常见问题与解决方案

问题:LLM 返回带 markdown 代码块

错误信息

Invalid input '```cypher': expected 'MATCH', 'MERGE', ...

某些模型会带一些前置和后置标记,有些不会,所以需要根据实际情况处理下。

解决方案:清理代码块标记

if cypher.startswith('```'):
    cypher = cypher.split('\n', 1)[1].rsplit('\n', 1)[0]

总结

  1. LLM 作为翻译器:将自然语言转换为 Cypher,降低图数据库使用门槛
  2. Schema 信息的重要性:提供结构信息能大幅提高 Cypher 生成的准确性
  3. APOC 的价值:提供元数据查询等高级功能,但非必需
  4. 错误处理:LLM 输出可能不规范,需做好清理和验证