惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园_首页
博客园 - 【当耐特】
博客园 - 叶小钗
阮一峰的网络日志
阮一峰的网络日志
WordPress大学
WordPress大学
D
Docker
T
The Blog of Author Tim Ferriss
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Microsoft Azure Blog
Microsoft Azure Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
月光博客
月光博客
M
MIT News - Artificial intelligence
H
Hackread – Cybersecurity News, Data Breaches, AI and More
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
云风的 BLOG
云风的 BLOG
F
Fortinet All Blogs
罗磊的独立博客
小众软件
小众软件
A
About on SuperTechFans
MyScale Blog
MyScale Blog
D
DataBreaches.Net
The GitHub Blog
The GitHub Blog
C
Check Point Blog
L
LangChain Blog

博客园_首页

Plist 二进制格式 Milvus 和 PGVector,哪个更好? OpenClaw 已过时?在 VS Code 中运行 Hermes Agent! 第30篇文章:一个大三计科生的自白 Manim如何在数学公式中完美显示中文? Docker 部署 RocketMQ 5 并发编程核心概念辨析 C#事务处理最佳实践:别再让“主表存了、明细丢了”的破事发生 CLI 是什么?为什么大厂突然集体卷命令行? 【从0到1构建一个ClaudeAgent】协作-自主Agent UIImageView 设置图片不生效的原因排查 最小二乘问题详解20:无先验约束下的增量式SFM自由网平差 痞子衡嵌入式:大话双核i.MXRT1180之XIP应用里借助MU实现可靠Flash IAP的方法 AI Chat 封装, SemanticKerne.AiProvider.Unified 已发布 Windows下右键编辑js文件无法打开记事本——在注册表中使用环境变量 在后台服务中使用 Scoped 服务,为什么总是报错? H200 安装驱动并使用sglang启动模型 wireshark 抓包Trap上报告警内容 我用 AI 辅助开发了一系列小工具(2):图片压缩工具 [A Primer On MC and CC] 2.1 Memory Consistency 1 - 指令重排序和 SC 模型 Oracle数据库SCN推进技术详解与实践指南 玩转控件:封装个带图片的Label控件 Claude Code 4.7 真正该升级的不是模型,而是你的工作流 前端小白一句话,AI 帮我做了个颜值拉满的桌面媒体播放器。当代码不再是门槛,一句话编程就是现实。 5. WorkBuddy: 小龙虾的灵魂三件套,让你的小龙虾不只是工具 SQLite 分片方案实战:三种分片策略的深度对比 告别简陋 UI!一款基于 Fluent Design 和基于 WinUI 的开源免费、现代化的 Avalonia UI 控件库 关于二进制排列组合枚举的总结 AI开发-python-LangGraph框架(3-27-LangGraph从零实现大模型智能决策工作流) ElasticSearch主分片和副本分片概念详解
Dify — 聊天助手 -- 知识库
VipSoft · 2026-05-27 · via 博客园_首页

Dify — Windows 下 Docker 安装 Dify
Dify — 聊天助手 -- 知识库
Dify — 文本生成应用
Dify — Agent 智能体
Dify — Chatflow - 文档知识库
Dify — 连接MySQL配置
Dify — Chatflow - 数据库智能查询
Dify — Workflow - 数据可视化

安装 Dify

Dify — Windows 下 Docker 安装 Dify

Dify中定义了五种应用类型:

  • 聊天助手:基于 LLM 构建对话式交互的助手。(多问多答)
  • 文本生成应用:面向文本生成类任务的助手,例如撰写故事、文本分类、翻译等。(一问一答)
  • Agent:能够分解任务、推理思考、调用工具的对话式智能助手。
  • 对话流:适用于定义等复杂流程的多轮对话场景,具有记忆功能的应用编排方式。
  • 工作流:适用于自动化、批处理等单轮生成类任务的场景的应用编排方式。

下面通过创建一个聊天助手来演示Dify中应用创建方式与流程。该聊天助手中引入了本地知识库,支持提示词中设置变量并让聊天助手从本地知识库中获取知识并回复。

接入模型

image
image

添加知识库

大模型先在本地知识库里找有没有相关知识,如果没有再去网上找
image
知识库:对文本内容进行分片(Chunk) -> 每个段进行向量化(Vector) => DB
提问:也会对输入的内容进行分片(Chunk) -> 进行向量化(Vector) -> 和知识库(DB)里的向量进行匹配 -> 找出片段 Chunk -> 交给大模型(LLM)-> 大模型进行回答

如果回答不准:

  1. LLM 大模型问题
  2. 知识库切分嵌入(Embedding)、参数问题

image
image
嵌入后的内容
1

创建聊天助手

image
image
image

  • 提示词:给当前机器人,设定一个角色,用于约束 AI 给出专业的回复,让回应更加精确。你可以借助内置的提示生成器,编写合适的提示词。提示词内支持插入表单变量,例如 {{input}}。提示词中的变量的值会替换成用户填写的值。
  • 知识库:如果想要让 AI 的对话范围局限在知识库内,例如企业内的客服话术规范,可以在“上下文”内引用知识库。

提示词可以通过:https://www.coze.cn/ Coze 生成

发布应用

image

检索设置

Top K 调高,或者 阈值调低
image

一个大文档,切分先多 Chunk 片段,可以设置 Chunk 的字符量是多少、两个Chunk有多少内容是重合的

Chunk 多少合适:

1个Chunk 不管问什么,都会返回这个,会掺杂很多无用的信息,造成不准
1万个 Chunk,有可能产生上下文断层,每个片段的信息量太少了
中文:500 字符左右,英文适当放大
image

如果搜索出来的片段,在Chunk2里,但是语义逻辑上的内容有可能也包含在了 Chunk1、Chunk3 里。只是包含得比较少,按阈值的方式,没有返回到上下文里,相当于也丢失了一些语义。
手动解决:当匹配到了 Chunk 后会把上面1、2个,下面1、2个也加到上下文里面(业界手动实现,采用的做法),加太多没有太大意义,可能会导致大模型回答不太精准,一般开发 RAG 是这么做的。
像Dify,不涉及代码开发,所以没办法做到RAG精准控制