惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Engineering at Meta
Engineering at Meta
罗磊的独立博客
Apple Machine Learning Research
Apple Machine Learning Research
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
有赞技术团队
有赞技术团队
小众软件
小众软件
GbyAI
GbyAI
J
Java Code Geeks
B
Blog
Blog — PlanetScale
Blog — PlanetScale
宝玉的分享
宝玉的分享
M
MIT News - Artificial intelligence
T
The Exploit Database - CXSecurity.com
Security Latest
Security Latest
阮一峰的网络日志
阮一峰的网络日志
NISL@THU
NISL@THU
T
Tenable Blog
S
Schneier on Security
T
Tor Project blog
V
V2EX
S
Secure Thoughts
P
Privacy International News Feed
Spread Privacy
Spread Privacy
博客园 - 三生石上(FineUI控件)
博客园_首页
T
Threatpost
月光博客
月光博客
Know Your Adversary
Know Your Adversary
Cyberwarzone
Cyberwarzone
T
The Blog of Author Tim Ferriss
H
Help Net Security
The Hacker News
The Hacker News
A
Arctic Wolf
B
Blog RSS Feed
雷峰网
雷峰网
The Last Watchdog
The Last Watchdog
S
SegmentFault 最新的问题
博客园 - 【当耐特】
Cisco Talos Blog
Cisco Talos Blog
Vercel News
Vercel News
Microsoft Security Blog
Microsoft Security Blog
A
About on SuperTechFans
P
Palo Alto Networks Blog
Attack and Defense Labs
Attack and Defense Labs
N
News | PayPal Newsroom
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
S
Securelist
L
LangChain Blog
I
InfoQ

博客园 - VipSoft

Python 项目简单部署(Linux) MinerU - 将非结构化文档(PDF、图片、Office 文件等)转换为机器可读的 Markdown 和 JSON LangChain 入门 服务端部署-FastAPI LangChain 入门 LangSmith LangChain 入门 实战 - 食谱推荐 LangChain 入门 Memory 会话记忆 LangChain 入门 Tools 工具 LangChain 入门 Tools 工具 LangChain 入门 Prompts 提示词 LangChain 入门 Message 消息 LangChain 入门 Model 的初始化和调用 LangChain 入门 Agent 的基本运行机制 AI 0基础学习,名词解析 LangChain 和 LangGraph AI大模型知识体系 Dify — Workflow - 数据可视化 Dify — 连接MySQL配置 Dify — Chatflow - 数据库智能查询 Dify — Chatflow - 文档知识库 Dify — Agent 智能体 高安全券码、注册码生成 Dify — 文本生成应用 Windows 下 Docker 安装 Dify Ollama — 命令 Ollama — 为什么能够运行不同的模型 Ollama — 接口 Qwen — 自定义模型文件 Ollama Qwen — 安装测试 Ollama Windows 安装 & 指定安装目录 跟着AI学AI - 诊断结论信息抽取 - 批量处理脚本 跟着AI学AI - 诊断结论信息抽取 - 模型压缩与部署 跟着AI学AI - 诊断结论信息抽取 - 模型评估与调试 跟着AI学AI - 诊断结论信息抽取 - 模型训练 轻型民用无人驾驶航空器安全操控理论考试培训材料 FreeRedis Helper Windbg w3wp.DMP 内存分析 跟着AI学AI - 诊断结论信息抽取 - 数据增强 QQ 录屏软件 Java - 加权随机算法 - 示例 Java - 加权随机算法--Demo Java LoadBalanceUtil 负载均衡、轮询加权 SpringBoot 集成 IP2Region 获取IP地域信息 Windows 服务器和虚拟主机,创建.开头的文件夹 .well-known 跟着AI学AI - 诊断结论信息抽取 - 数据格式转换BERT训练格式 跟着AI学AI - 诊断结论信息抽取 - LabelStudio 标注 -- 结论标注 跟着AI学AI - 诊断结论信息抽取 - 学习路径 跟着AI学AI - UV 安装 数据标注工具 Label-Studio `VIRTUAL_ENV=venv` does not match the project environment 跟着AI学AI - 学习路径 - 命名实体识别(NER)和信息抽取(IE) 跟着AI学AI - 需要购买显卡吗? C# 无BOM的UTF-8编码 Vue ref reactive Vue - el-table 嵌套表 Spring `@Scheduled` 中这些参数的区别、组合和应用场景 Python 找出同步日志中的重复数据 Python - UV PyCharm 不能识别 .venv 的环境
Dify — 聊天助手 -- 知识库
VipSoft · 2026-05-27 · via 博客园 - VipSoft

Dify — Windows 下 Docker 安装 Dify
Dify — 聊天助手 -- 知识库
Dify — 文本生成应用
Dify — Agent 智能体
Dify — Chatflow - 文档知识库
Dify — 连接MySQL配置
Dify — Chatflow - 数据库智能查询
Dify — Workflow - 数据可视化

安装 Dify

Dify — Windows 下 Docker 安装 Dify

Dify中定义了五种应用类型:

  • 聊天助手:基于 LLM 构建对话式交互的助手。(多问多答)
  • 文本生成应用:面向文本生成类任务的助手,例如撰写故事、文本分类、翻译等。(一问一答)
  • Agent:能够分解任务、推理思考、调用工具的对话式智能助手。
  • 对话流:适用于定义等复杂流程的多轮对话场景,具有记忆功能的应用编排方式。
  • 工作流:适用于自动化、批处理等单轮生成类任务的场景的应用编排方式。

下面通过创建一个聊天助手来演示Dify中应用创建方式与流程。该聊天助手中引入了本地知识库,支持提示词中设置变量并让聊天助手从本地知识库中获取知识并回复。

接入模型

image
image

添加知识库

大模型先在本地知识库里找有没有相关知识,如果没有再去网上找
image
知识库:对文本内容进行分片(Chunk) -> 每个段进行向量化(Vector) => DB
提问:也会对输入的内容进行分片(Chunk) -> 进行向量化(Vector) -> 和知识库(DB)里的向量进行匹配 -> 找出片段 Chunk -> 交给大模型(LLM)-> 大模型进行回答

如果回答不准:

  1. LLM 大模型问题
  2. 知识库切分嵌入(Embedding)、参数问题

image
image
嵌入后的内容
1

创建聊天助手

image
image
image

  • 提示词:给当前机器人,设定一个角色,用于约束 AI 给出专业的回复,让回应更加精确。你可以借助内置的提示生成器,编写合适的提示词。提示词内支持插入表单变量,例如 {{input}}。提示词中的变量的值会替换成用户填写的值。
  • 知识库:如果想要让 AI 的对话范围局限在知识库内,例如企业内的客服话术规范,可以在“上下文”内引用知识库。

提示词可以通过:https://www.coze.cn/ Coze 生成

发布应用

image

检索设置

Top K 调高,或者 阈值调低
image

一个大文档,切分先多 Chunk 片段,可以设置 Chunk 的字符量是多少、两个Chunk有多少内容是重合的

Chunk 多少合适:

1个Chunk 不管问什么,都会返回这个,会掺杂很多无用的信息,造成不准
1万个 Chunk,有可能产生上下文断层,每个片段的信息量太少了
中文:500 字符左右,英文适当放大
image

如果搜索出来的片段,在Chunk2里,但是语义逻辑上的内容有可能也包含在了 Chunk1、Chunk3 里。只是包含得比较少,按阈值的方式,没有返回到上下文里,相当于也丢失了一些语义。
手动解决:当匹配到了 Chunk 后会把上面1、2个,下面1、2个也加到上下文里面(业界手动实现,采用的做法),加太多没有太大意义,可能会导致大模型回答不太精准,一般开发 RAG 是这么做的。
像Dify,不涉及代码开发,所以没办法做到RAG精准控制